Classificação de trocadilhos em português com BERTimbau large: desafios e resultados
Loading...
Date
Authors
Journal Title
Journal ISSN
Volume Title
Publisher
Instituto Federal de Educação, Ciência e Tecnologia do Piauí
Resumo
Este trabalho apresenta um estudo sobre a detecção automática de trocadilhos em português,
umdesafio significativo no campo do Processamento de Linguagem Natural (PLN) devido à
ambiguidade semântica e à dependência de contexto. Para a análise, foi utilizado o corpus
Puntuguese, uma coleção inédita composta por 3.990 textos curtos, igualmente divididos entre
trocadilhos e não trocadilhos, provenientes de diferentes fontes como blogs, redes sociais e
vídeos no YouTube. O modelo BERTimbau Large, especializado nas variações do português
brasileiro e europeu, foi aplicado para analisar as sentenças. O trabalho também envolveu
técnicas de pré-processamento e a extração de padrões linguísticos por expressões regulares,
que ajudaram na análise dos dados. A tarefa de identificar trocadilhos é desafiadora devido
às particularidades e sutilezas que esse tipo de humor envolve, exigindo uma compreensão
profunda das estruturas linguísticas. Este estudo oferece uma contribuição importante para o
avanço da detecção de humorverbal em português e abre portas para futuros desenvolvimentos
na área
Description
Keywords
processamento de linguagem natural, natural language processing, detecção automática de trocadilhos, automatic detection of puns, bertimbau large, large bertimbau, humor verbal computacional, computational verbal humor, classificação de textos em português, text classification in Portuguese