Classificação da utilidade de respostas em saúde com base em votos comunitários: uma abordagem automatizada para sistemas de qa

dc.contributor.advisor1 Sousa, Rogério Figueredo De
dc.contributor.advisor1Lattes http://lattes.cnpq.br/9346694618502913pt_BR
dc.creator Barros, Carlos Henrique Santos
dc.creator.Lattes http://lattes.cnpq.br/2475000984926109pt_BR
dc.date.accessioned 2025-10-28T23:43:07Z
dc.date.available 2025-10-28T23:43:07Z
dc.date.issued 2025
dc.description.abstract This work investigates the classification of answer usefulness in health-related Question and Answer services. We propose a supervised method that combines Natural Language Processing techniques with community interaction signals to prioritize useful answers. We constructed the SaudeBR-QA corpus from CatálogoMed, from which 3,010 question–answer pairs were selected and labeled based on votes/likes. Seven classifiers were optimized via stratified cross-validation. Random Forest achieved the best balance between accuracy and F1 on the test set (79.07%) accuracy and 79% F1macro). A user study, conducted through an online form, collected judgments from both the general public and health professionals, revealing alignment between the model and human consensus as well as occasional divergences. The results demonstrate the feasibility of lightweight models to support answer ranking and improve access to medical information, and they also provide a public corpus and a reproducible protocol for future research.pt_BR
dc.description.resumo Este trabalho investiga a classificação da utilidade de respostas em serviços de Perguntas e Respostas na área da saúde. A pesquisa propõe um método supervisionado que combina técnicas de Processamento de Linguagem Natural e sinais de interação comunitária para priorizar respostas úteis. Foi construído o córpus SaudeBR-QA a partir do CatálogoMed, do qual se selecionaram 3.010 pares pergunta–resposta rotulados com base em votos/curtidas. Sete classificadores foram otimizados por validação cruzada estratificada. O Random Forest apresentou o melhor equilíbrio entre acurácia e F1 no conjunto de teste (acurácia de 79,07% e F1macro de 79%). A avaliação com usuários, por meio de um formulário, coletou julgamentos de público geral e profissionais de saúde, evidenciando alinhamento entre o modelo e o consenso humano e eventuais divergências. Os resultados demonstram a viabilidade de modelos leves para apoiar o ranqueamento de respostas e qualificar o acesso a informações médicas, além de disponibilizar um córpus público e um protocolo reprodutível para pesquisas futuras.pt_BR
dc.identifier.uri https://bia.ifpi.edu.br/jspui/handle/123456789/4938
dc.language porpt_BR
dc.publisher Instituto Federal de Educação, Ciência e Tecnologia do Piauípt_BR
dc.publisher.country Brasilpt_BR
dc.publisher.department Campus Picospt_BR
dc.publisher.initials IFPIpt_BR
dc.rights Acesso Abertopt_BR
dc.subject saúdept_BR
dc.subject votospt_BR
dc.subject aprendizado de máquinapt_BR
dc.subject.cnpq CNPQ::CIENCIAS EXATAS E DA TERRApt_BR
dc.title Classificação da utilidade de respostas em saúde com base em votos comunitários: uma abordagem automatizada para sistemas de qapt_BR
dc.type Trabalho de Conclusão de Cursopt_BR

Files

Original bundle

Now showing 1 - 2 of 2
Loading...
Thumbnail Image
Name:
2025_tcc_chsbarros.pdf
Size:
478.36 KB
Format:
Adobe Portable Document Format
Description:
Loading...
Thumbnail Image
Name:
2025_termo_chsbarros.pdf
Size:
246.43 KB
Format:
Description:

License bundle

Now showing 1 - 1 of 1
Loading...
Thumbnail Image
Name:
license.txt
Size:
1.82 KB
Format:
Item-specific license agreed upon to submission
Description: