@inproceedings{teixeira-caseli-2026-heuristicas,
title = "Heur{\'i}sticas vs. {LLM}s na triagem de tweets: avaliando pistas lingu{\'i}sticas para tarefas de {PLN} em portugu{\^e}s",
author = "Teixeira, Laura Pessine and
Caseli, Helena de Medeiros",
editor = "Barbosa, Bryan Khelven da Silva and
Paes, Aline and
Felippo, Ariani Di",
booktitle = "Proceedings of the 17th {B}razilian Symposium in Information and Human Language Technology",
month = oct,
year = "2026",
address = "Cuiab{\'a}, Mato Grosso, Brazil",
publisher = "Association for Computational Linguistics",
url = "https://aclanthology.org/2026.stil-1.61/",
doi = "10.5753/stil.2026.29820",
pages = "626--631",
abstract = "Este artigo apresenta um pipeline de triagem inteligente para pr{\'e}-processamento de textos informais em tarefas de Processamento de Linguagem Natural (PLN). O pipeline pontua a utilidade textual usando pistas lingu{\'i}sticas fundamentadas na dimens{\~a}o ret{\'o}rica da argumenta{\c{c}}{\~a}o (clareza, credibilidade, apelo emocional e organiza{\c{c}}{\~a}o). Uma avalia{\c{c}}{\~a}o intr{\'i}nseca comparou o pipeline proposto com um Large Language Model (LLM) utilizando um padr{\~a}o ouro humano. Os resultados mostram que o pipeline obteve maior precis{\~a}o em caracter{\'i}sticas objetivas, enquanto elementos subjetivos exigem modelos contextuais. Esses resultados indicam que uma arquitetura h{\'i}brida pode ser uma estrat{\'e}gia mais eficaz para a curadoria de dados textuais."
}<?xml version="1.0" encoding="UTF-8"?>
<modsCollection xmlns="http://www.loc.gov/mods/v3">
<mods ID="teixeira-caseli-2026-heuristicas">
<titleInfo>
<title>Heurísticas vs. LLMs na triagem de tweets: avaliando pistas linguísticas para tarefas de PLN em português</title>
</titleInfo>
<name type="personal">
<namePart type="given">Laura</namePart>
<namePart type="given">Pessine</namePart>
<namePart type="family">Teixeira</namePart>
<role>
<roleTerm authority="marcrelator" type="text">author</roleTerm>
</role>
</name>
<name type="personal">
<namePart type="given">Helena</namePart>
<namePart type="given">de</namePart>
<namePart type="given">Medeiros</namePart>
<namePart type="family">Caseli</namePart>
<role>
<roleTerm authority="marcrelator" type="text">author</roleTerm>
</role>
</name>
<originInfo>
<dateIssued>2026-10</dateIssued>
</originInfo>
<typeOfResource>text</typeOfResource>
<relatedItem type="host">
<titleInfo>
<title>Proceedings of the 17th Brazilian Symposium in Information and Human Language Technology</title>
</titleInfo>
<name type="personal">
<namePart type="given">Bryan</namePart>
<namePart type="given">Khelven</namePart>
<namePart type="given">da</namePart>
<namePart type="given">Silva</namePart>
<namePart type="family">Barbosa</namePart>
<role>
<roleTerm authority="marcrelator" type="text">editor</roleTerm>
</role>
</name>
<name type="personal">
<namePart type="given">Aline</namePart>
<namePart type="family">Paes</namePart>
<role>
<roleTerm authority="marcrelator" type="text">editor</roleTerm>
</role>
</name>
<name type="personal">
<namePart type="given">Ariani</namePart>
<namePart type="given">Di</namePart>
<namePart type="family">Felippo</namePart>
<role>
<roleTerm authority="marcrelator" type="text">editor</roleTerm>
</role>
</name>
<originInfo>
<publisher>Association for Computational Linguistics</publisher>
<place>
<placeTerm type="text">Cuiabá, Mato Grosso, Brazil</placeTerm>
</place>
</originInfo>
<genre authority="marcgt">conference publication</genre>
</relatedItem>
<abstract>Este artigo apresenta um pipeline de triagem inteligente para pré-processamento de textos informais em tarefas de Processamento de Linguagem Natural (PLN). O pipeline pontua a utilidade textual usando pistas linguísticas fundamentadas na dimensão retórica da argumentação (clareza, credibilidade, apelo emocional e organização). Uma avaliação intrínseca comparou o pipeline proposto com um Large Language Model (LLM) utilizando um padrão ouro humano. Os resultados mostram que o pipeline obteve maior precisão em características objetivas, enquanto elementos subjetivos exigem modelos contextuais. Esses resultados indicam que uma arquitetura híbrida pode ser uma estratégia mais eficaz para a curadoria de dados textuais.</abstract>
<identifier type="citekey">teixeira-caseli-2026-heuristicas</identifier>
<identifier type="doi">10.5753/stil.2026.29820</identifier>
<location>
<url>https://aclanthology.org/2026.stil-1.61/</url>
</location>
<part>
<date>2026-10</date>
<extent unit="page">
<start>626</start>
<end>631</end>
</extent>
</part>
</mods>
</modsCollection>
%0 Conference Proceedings
%T Heurísticas vs. LLMs na triagem de tweets: avaliando pistas linguísticas para tarefas de PLN em português
%A Teixeira, Laura Pessine
%A Caseli, Helena de Medeiros
%Y Barbosa, Bryan Khelven da Silva
%Y Paes, Aline
%Y Felippo, Ariani Di
%S Proceedings of the 17th Brazilian Symposium in Information and Human Language Technology
%D 2026
%8 October
%I Association for Computational Linguistics
%C Cuiabá, Mato Grosso, Brazil
%F teixeira-caseli-2026-heuristicas
%X Este artigo apresenta um pipeline de triagem inteligente para pré-processamento de textos informais em tarefas de Processamento de Linguagem Natural (PLN). O pipeline pontua a utilidade textual usando pistas linguísticas fundamentadas na dimensão retórica da argumentação (clareza, credibilidade, apelo emocional e organização). Uma avaliação intrínseca comparou o pipeline proposto com um Large Language Model (LLM) utilizando um padrão ouro humano. Os resultados mostram que o pipeline obteve maior precisão em características objetivas, enquanto elementos subjetivos exigem modelos contextuais. Esses resultados indicam que uma arquitetura híbrida pode ser uma estratégia mais eficaz para a curadoria de dados textuais.
%R 10.5753/stil.2026.29820
%U https://aclanthology.org/2026.stil-1.61/
%U https://doi.org/10.5753/stil.2026.29820
%P 626-631
Markdown (Informal)
[Heurísticas vs. LLMs na triagem de tweets: avaliando pistas linguísticas para tarefas de PLN em português](https://aclanthology.org/2026.stil-1.61/) (Teixeira & Caseli, STIL 2026)
ACL