Classificação de trocadilhos em português com BERTimbau large: desafios e resultados

Loading...
Thumbnail Image

Date

Journal Title

Journal ISSN

Volume Title

Publisher

Instituto Federal de Educação, Ciência e Tecnologia do Piauí

Resumo

Este trabalho apresenta um estudo sobre a detecção automática de trocadilhos em português, umdesafio significativo no campo do Processamento de Linguagem Natural (PLN) devido à ambiguidade semântica e à dependência de contexto. Para a análise, foi utilizado o corpus Puntuguese, uma coleção inédita composta por 3.990 textos curtos, igualmente divididos entre trocadilhos e não trocadilhos, provenientes de diferentes fontes como blogs, redes sociais e vídeos no YouTube. O modelo BERTimbau Large, especializado nas variações do português brasileiro e europeu, foi aplicado para analisar as sentenças. O trabalho também envolveu técnicas de pré-processamento e a extração de padrões linguísticos por expressões regulares, que ajudaram na análise dos dados. A tarefa de identificar trocadilhos é desafiadora devido às particularidades e sutilezas que esse tipo de humor envolve, exigindo uma compreensão profunda das estruturas linguísticas. Este estudo oferece uma contribuição importante para o avanço da detecção de humorverbal em português e abre portas para futuros desenvolvimentos na área

Description

Keywords

processamento de linguagem natural, natural language processing, detecção automática de trocadilhos, automatic detection of puns, bertimbau large, large bertimbau, humor verbal computacional, computational verbal humor, classificação de textos em português, text classification in Portuguese

Citation

Endorsement

Review

Supplemented By

Referenced By