BIA - IFPI Campus Picos Tecnologia Tecnologia em Análise e Desenvolvimento de Sistemas - Picos
Use este identificador para citar ou linkar para este item: https://bia.ifpi.edu.br/jspui/handle/123456789/5839
Registro completo de metadados
Campo DCValorIdioma
dc.creatorSilva, Joyce Moura-
dc.date.accessioned2026-08-25T11:35:54Z-
dc.date.available2026-08-25T11:35:54Z-
dc.date.issued2025-02-13-
dc.identifier.urihttps://bia.ifpi.edu.br/jspui/handle/123456789/5839-
dc.description.abstractAutomated Essay Scoring is one of the most important educational applications of natural language processing. It helps teachers with automatic assessments, providing a cheaper, faster, and more deterministic approach than humans when scoring essays. Nevertheless, off-topic essays pose challenges in this area, causing an automated grader to overestimate the score of an essay that does not adhere to a proposed topic. Thus, detecting off-topic essays is important for dealing with unrelated text responses to a given topic. This paper explored approaches based on handcrafted features to feed supervised machine-learning algorithms, tuning a BERT model, and prompt engineering with a large language model. We assessed these strategies in a public corpus of Portuguese essays, achieving the best result using a fine-tuned BERT model with a 75% balanced accuracy. Furthermore, this strategy was able to identify low-quality essays.pt_BR
dc.description.sponsorshipAgência 1pt_BR
dc.languageporpt_BR
dc.publisherInstituto Federal de Educação, Ciência e Tecnologia do Piauípt_BR
dc.rightsAcesso Abertopt_BR
dc.subjectAutomated Essay Scoring, Off-Topic Essays, BERT.pt_BR
dc.titleInvestigating Methods to Detect Off-Topic Essayspt_BR
dc.title.alternativeInvestigando métodos para detectar redações fora do tema.pt_BR
dc.typeTrabalho de Conclusão de Cursopt_BR
dc.creator.ID04924829340pt_BR
dc.creator.Latteshttp://lattes.cnpq.br/5034898118586859pt_BR
dc.contributor.advisor1Anchiêta, Rafael Torres-
dc.contributor.advisor1Latteshttp://lattes.cnpq.br/702189535765436pt_BR
dc.contributor.referee1Medeiros, Manoel Messias Pereira-
dc.contributor.referee1Latteshttp://lattes.cnpq.br/3692751461745479pt_BR
dc.contributor.referee2Sousa, Rogério Figueredo-
dc.contributor.referee2Latteshttp://lattes.cnpq.br/9346694618502913.pt_BR
dc.description.resumoA Avaliação Automatizada de Redações (Automated Essay Scoring) é uma das aplicações educacionais mais importantes do processamento de linguagem natural. Ela auxilia os professores na avaliação automática, oferecendo uma abordagem mais barata, rápida e determinística do que a avaliação humana na atribuição de notas às redações. No entanto, redações que fogem do tema proposto representam desafios nessa área, fazendo com que um avaliador automatizado superestime a nota de uma redação que não está de acordo com o tema proposto. Assim, detectar redações fora do tema é importante para lidar com respostas textuais não relacionadas ao tema apresentado. Este artigo explorou abordagens baseadas em características elaboradas manualmente para alimentar algoritmos de aprendizado de máquina supervisionado, o ajuste fino de um modelo BERT e a engenharia de prompts com um modelo de linguagem de grande escala. Avaliamos essas estratégias em um corpus público de redações em português, obtendo o melhor resultado com um modelo BERT ajustado, que alcançou 75% de acurácia balanceada. Além disso, essa estratégia foi capaz de identificar redações de baixa qualidade.pt_BR
dc.publisher.countryBrasilpt_BR
dc.publisher.departmentCampus Picospt_BR
dc.publisher.initialsIFPIpt_BR
dc.subject.cnpqInteligência Artificialpt_BR
dc.subject.cnpqComputaçãopt_BR
Aparece nas coleções:Tecnologia em Análise e Desenvolvimento de Sistemas - Picos

Arquivos associados a este item:
Arquivo Descrição TamanhoFormato 
2025_tcc_jmsilva.pdf216.02 kBAdobe PDFVisualizar/Abrir
2025_termo_jmsilva.pdf215.73 kBAdobe PDFVisualizar/Abrir


Os itens no repositório estão protegidos por copyright, com todos os direitos reservados, salvo quando é indicado o contrário.