@inproceedings{pinto-etal-2026-explorando,
title = "Explorando a Integra{\c{c}}{\~a}o de M{\'u}ltiplas Modalidades Visuais no Reconhecimento Cont{\'i}nuo de {L}ibras",
author = "Pinto, Guilherme Galv{\~a}o de Oliveira and
Vieira Leite, Guilherme and
Pedrini, H{\'e}lio and
Martino, Jos{\'e} Mario De",
editor = "Barbosa, Bryan Khelven da Silva and
Paes, Aline and
Felippo, Ariani Di",
booktitle = "Proceedings of the 17th {B}razilian Symposium in Information and Human Language Technology",
month = oct,
year = "2026",
address = "Cuiab{\'a}, Mato Grosso, Brazil",
publisher = "Association for Computational Linguistics",
url = "https://aclanthology.org/2026.stil-1.55/",
doi = "10.5753/stil.2026.29828",
pages = "594--599",
abstract = "O reconhecimento cont{\'i}nuo de L{\'i}ngua Brasileira de Sinais (Libras) apresenta desafios relacionados {\`a} natureza multimodal da sinaliza{\c{c}}{\~a}o e {\`a} modelagem de depend{\^e}ncias espa{\c{c}}o-temporais complexas. Este trabalho em andamento busca investigar a adapta{\c{c}}{\~a}o de arquiteturas neurais para o reconhecimento cont{\'i}nuo de Libras utilizando v{\'i}deos RGB, keypoints corporais, faciais e manuais, al{\'e}m de anota{\c{c}}{\~o}es lingu{\'i}sticas multi-tier produzidas no ELAN. O m{\'e}todo proposto combina extra{\c{c}}{\~a}o de caracter{\'i}sticas visuais, integra{\c{c}}{\~a}o multimodal e modelagem temporal. A avalia{\c{c}}{\~a}o ser{\'a} realizada por meio da m{\'e}trica Word Error Rate (WER) e estudos de abla{\c{c}}{\~a}o. Espera-se analisar o impacto da multimodalidade e das anota{\c{c}}{\~o}es multicamadas no desempenho de modelos de reconhecimento cont{\'i}nuo de Libras."
}<?xml version="1.0" encoding="UTF-8"?>
<modsCollection xmlns="http://www.loc.gov/mods/v3">
<mods ID="pinto-etal-2026-explorando">
<titleInfo>
<title>Explorando a Integração de Múltiplas Modalidades Visuais no Reconhecimento Contínuo de Libras</title>
</titleInfo>
<name type="personal">
<namePart type="given">Guilherme</namePart>
<namePart type="given">Galvão</namePart>
<namePart type="given">de</namePart>
<namePart type="given">Oliveira</namePart>
<namePart type="family">Pinto</namePart>
<role>
<roleTerm authority="marcrelator" type="text">author</roleTerm>
</role>
</name>
<name type="personal">
<namePart type="given">Guilherme</namePart>
<namePart type="family">Vieira Leite</namePart>
<role>
<roleTerm authority="marcrelator" type="text">author</roleTerm>
</role>
</name>
<name type="personal">
<namePart type="given">Hélio</namePart>
<namePart type="family">Pedrini</namePart>
<role>
<roleTerm authority="marcrelator" type="text">author</roleTerm>
</role>
</name>
<name type="personal">
<namePart type="given">José</namePart>
<namePart type="given">Mario</namePart>
<namePart type="given">De</namePart>
<namePart type="family">Martino</namePart>
<role>
<roleTerm authority="marcrelator" type="text">author</roleTerm>
</role>
</name>
<originInfo>
<dateIssued>2026-10</dateIssued>
</originInfo>
<typeOfResource>text</typeOfResource>
<relatedItem type="host">
<titleInfo>
<title>Proceedings of the 17th Brazilian Symposium in Information and Human Language Technology</title>
</titleInfo>
<name type="personal">
<namePart type="given">Bryan</namePart>
<namePart type="given">Khelven</namePart>
<namePart type="given">da</namePart>
<namePart type="given">Silva</namePart>
<namePart type="family">Barbosa</namePart>
<role>
<roleTerm authority="marcrelator" type="text">editor</roleTerm>
</role>
</name>
<name type="personal">
<namePart type="given">Aline</namePart>
<namePart type="family">Paes</namePart>
<role>
<roleTerm authority="marcrelator" type="text">editor</roleTerm>
</role>
</name>
<name type="personal">
<namePart type="given">Ariani</namePart>
<namePart type="given">Di</namePart>
<namePart type="family">Felippo</namePart>
<role>
<roleTerm authority="marcrelator" type="text">editor</roleTerm>
</role>
</name>
<originInfo>
<publisher>Association for Computational Linguistics</publisher>
<place>
<placeTerm type="text">Cuiabá, Mato Grosso, Brazil</placeTerm>
</place>
</originInfo>
<genre authority="marcgt">conference publication</genre>
</relatedItem>
<abstract>O reconhecimento contínuo de Língua Brasileira de Sinais (Libras) apresenta desafios relacionados à natureza multimodal da sinalização e à modelagem de dependências espaço-temporais complexas. Este trabalho em andamento busca investigar a adaptação de arquiteturas neurais para o reconhecimento contínuo de Libras utilizando vídeos RGB, keypoints corporais, faciais e manuais, além de anotações linguísticas multi-tier produzidas no ELAN. O método proposto combina extração de características visuais, integração multimodal e modelagem temporal. A avaliação será realizada por meio da métrica Word Error Rate (WER) e estudos de ablação. Espera-se analisar o impacto da multimodalidade e das anotações multicamadas no desempenho de modelos de reconhecimento contínuo de Libras.</abstract>
<identifier type="citekey">pinto-etal-2026-explorando</identifier>
<identifier type="doi">10.5753/stil.2026.29828</identifier>
<location>
<url>https://aclanthology.org/2026.stil-1.55/</url>
</location>
<part>
<date>2026-10</date>
<extent unit="page">
<start>594</start>
<end>599</end>
</extent>
</part>
</mods>
</modsCollection>
%0 Conference Proceedings
%T Explorando a Integração de Múltiplas Modalidades Visuais no Reconhecimento Contínuo de Libras
%A Pinto, Guilherme Galvão de Oliveira
%A Vieira Leite, Guilherme
%A Pedrini, Hélio
%A Martino, José Mario De
%Y Barbosa, Bryan Khelven da Silva
%Y Paes, Aline
%Y Felippo, Ariani Di
%S Proceedings of the 17th Brazilian Symposium in Information and Human Language Technology
%D 2026
%8 October
%I Association for Computational Linguistics
%C Cuiabá, Mato Grosso, Brazil
%F pinto-etal-2026-explorando
%X O reconhecimento contínuo de Língua Brasileira de Sinais (Libras) apresenta desafios relacionados à natureza multimodal da sinalização e à modelagem de dependências espaço-temporais complexas. Este trabalho em andamento busca investigar a adaptação de arquiteturas neurais para o reconhecimento contínuo de Libras utilizando vídeos RGB, keypoints corporais, faciais e manuais, além de anotações linguísticas multi-tier produzidas no ELAN. O método proposto combina extração de características visuais, integração multimodal e modelagem temporal. A avaliação será realizada por meio da métrica Word Error Rate (WER) e estudos de ablação. Espera-se analisar o impacto da multimodalidade e das anotações multicamadas no desempenho de modelos de reconhecimento contínuo de Libras.
%R 10.5753/stil.2026.29828
%U https://aclanthology.org/2026.stil-1.55/
%U https://doi.org/10.5753/stil.2026.29828
%P 594-599
Markdown (Informal)
[Explorando a Integração de Múltiplas Modalidades Visuais no Reconhecimento Contínuo de Libras](https://aclanthology.org/2026.stil-1.55/) (Pinto et al., STIL 2026)
ACL