BIA - IFPI Campus Picos Tecnologia Tecnologia em Análise e Desenvolvimento de Sistemas - Picos
Use este identificador para citar ou linkar para este item: https://bia.ifpi.edu.br/jspui/handle/123456789/4819
Tipo: Trabalho de Conclusão de Curso
Título: Classificação de trocadilhos em português com BERTimbau large: desafios e resultados
Autor: Sousa, Êmylle Beatriz
Orientador(a): Sousa, Aislan Rafael Rodrigues
metadata.dc.contributor.advisor-co1: Anchiêta, Rafael Torres
metadata.dc.contributor.referee1: Abreu, Jader Anderson Oliveira
metadata.dc.contributor.referee2: Nacimento , João Paulo Lima
Resumo: Este trabalho apresenta um estudo sobre a detecção automática de trocadilhos em português, umdesafio significativo no campo do Processamento de Linguagem Natural (PLN) devido à ambiguidade semântica e à dependência de contexto. Para a análise, foi utilizado o corpus Puntuguese, uma coleção inédita composta por 3.990 textos curtos, igualmente divididos entre trocadilhos e não trocadilhos, provenientes de diferentes fontes como blogs, redes sociais e vídeos no YouTube. O modelo BERTimbau Large, especializado nas variações do português brasileiro e europeu, foi aplicado para analisar as sentenças. O trabalho também envolveu técnicas de pré-processamento e a extração de padrões linguísticos por expressões regulares, que ajudaram na análise dos dados. A tarefa de identificar trocadilhos é desafiadora devido às particularidades e sutilezas que esse tipo de humor envolve, exigindo uma compreensão profunda das estruturas linguísticas. Este estudo oferece uma contribuição importante para o avanço da detecção de humorverbal em português e abre portas para futuros desenvolvimentos na área
Abstract: This paper presents a study on the automatic detection of puns in Portuguese, a significant challenge in the field of Natural Language Processing (NLP) due to semantic ambiguity and context dependence. For the analysis, we used the Puntuguese corpus, a unique collection of 3,990 short texts, equally divided between puns and non-puns, from various sources such as blogs, social media, and YouTube videos. The BERTimbau Large model, specialized in variations of Brazilian and European Portuguese, was applied to analyze the sentences. The work also involved preprocessing techniques and the extraction of linguistic patterns using regular expressions, which aided in data analysis. The task of identifying puns is challenging due to the particularities and subtleties of this type of humor, requiring a deep understanding of linguistic structures. This study offers an important contribution to the advancement of verbal humor detection in Portuguese and opens doors for future developments in the field
Palavras-chave: processamento de linguagem natural
natural language processing
detecção automática de trocadilhos
automatic detection of puns
bertimbau large
large bertimbau
humor verbal computacional
computational verbal humor
classificação de textos em português
text classification in Portuguese
Cnpq: CNPQ::CIENCIAS EXATAS E DA TERRA::CIENCIA DA COMPUTACAO::METODOLOGIA E TECNICAS DA COMPUTACAO::LINGUAGENS DE PROGRAMACAO
metadata.dc.language: por
País: Brasil
Editor: Instituto Federal de Educação, Ciência e Tecnologia do Piauí
Sigla: IFPI
Unidade: Campus Picos
Tipo de acesso: Acesso Aberto
URI: https://bia.ifpi.edu.br/jspui/handle/123456789/4819
Data do documento: 2025
Aparece nas coleções:Tecnologia em Análise e Desenvolvimento de Sistemas - Picos

Arquivos associados a este item:
Arquivo Descrição TamanhoFormato 
2025_tcc_êbsousa.pdf400.52 kBAdobe PDFVisualizar/Abrir


Os itens no repositório estão protegidos por copyright, com todos os direitos reservados, salvo quando é indicado o contrário.