DESEMPENHO DO CHATGPT 3.5 PARA RESPONDER QUESTÕES DE MÚLTIPLA-ESCOLHA EM ORTOPEDIA E TRAUMATOLOGIA

Authors

  • Vitor Ricardo Thais Malvezzi
  • Rebecca Fantuzzi
  • Sarah Domitila Menezes Mourão
  • Jean Canhete
  • Franciele Cascaes da Silva

DOI:

https://doi.org/10.63845/txjhe680

Keywords:

IA, ChatGPT, Medicina, Ortopedia

Abstract

Introdução: A IA e o ChatGPT oferecem inúmeras possibilidades que envolvem ensino médico, prática clínica e cirúrgica. A adição de agentes com capacidade de análise lógica amplia ainda mais essas possibilidades. No entanto, a IA também é suscetível a falhas e erros. Já o desempenho do GPT-3.5 em responder questões ortopédicas é desconhecido. Objetivo: Analisar o desempenho do GTP-3.5 para responder questões de múltiplas escolhas em Ortopedia e Traumatologia. Método: Foram utilizadas questões de ortopedia múltipla-escolha aplicadas em provas de uma universidade de medicina no sul do Brasil. Após seleção, restaram 66 questões. Essas foram classificadas subjetivamente por conteúdo e objetivamente por tamanho, seja de seu enunciado e seja pelo comprimento das alternativas. Finalmente, foi avaliada a veracidade da alternativa escolhida, classificando-as como corretas ou incorretas. Resultados: Dentro deste estudo observou-se uma média total de assertividade de 43,93% das questões, enquanto que 56,06% foram respondidas incorretamente. O grupo de questões com enunciados longos com alternativas longas, destacou-se positivamente com 54,55% de acertos, e dentre eles as questões sobre conduta obtiveram 62,5% de acertos. Por outro lado, enunciados curtos e alternativas longas apresentaram 68,75% de erros. Conclusão: A união dos modelos chatbot de inteligência artificial como o GPT-3.5 e a prática médica ortopédica/acadêmica aparenta não estar pronta. Por mais que a média percentual de respostas corretas em determinados conjuntos ultrapasse 50%, em geral não se observou tal resultado. Os ortopedistas, residentes e acadêmicos de medicina devem estar cientes da limitação que hoje possui o GPT-3.5.

572 139

References

SILVA, J. A. S.; MAIRINK, C. H. P. Inteligência artificial: aliada ou inimiga. LIBERTAS: Rev. Ciênci. Soc. Apl., Belo Horizonte, v. 9, n. 2, p. 64-85, ago./dez. 2019.

Lobo LC. Inteligência artificial, o futuro da medicina e a educação médica. Rev Bras Educ Med. 2018;42:3-8. doi: 10.1590/1981-52712015v42n3RB20180115EDITORIAL1. DOI: https://doi.org/10.1590/1981-52712015v42n3rb20180115editorial1

Ramos ASM. Inteligência artificial generativa baseada em grandes modelos de linguagem: ferramentas de uso na pesquisa acadêmica. 2023. DOI: https://doi.org/10.1590/SciELOPreprints.6105

Tang S, Yang X, Shajudeen P, Sears C, Taraballi F, Weiner B, Tasciotti E, Dollahon D, Park H, Righetti R. A CNN-based method to reconstruct 3-D spine surfaces from US images in vivo. Med Image Anal. 2021 Dec;74:102221. doi: 10.1016/j.media.2021.102221. Epub 2021 Sep 1. PMID: 34520960. DOI: https://doi.org/10.1016/j.media.2021.102221

Kuo RYL, Harrison C, Curran TA, Jones B, Freethy A, Cussons D, Stewart M, Collins GS, Furniss D. Artificial Intelligence in Fracture Detection: A Systematic Review and Meta-Analysis. Radiology. 2022 Jul;304(1):50-62. doi: 10.1148/radiol.211785. Epub 2022 Mar 29. PMID: 35348381; PMCID: PMC9270679. DOI: https://doi.org/10.1148/radiol.211785

Rigamonti L, Albrecht UV, Lutter C, Tempel M, Wolfarth B, Back DA; Working Group Digitalisation. Potentials of Digitalization in Sports Medicine: A Narrative Review. Curr Sports Med Rep. 2020 Apr;19(4):157-163. doi: 10.1249/JSR.0000000000000704. PMID: 32282462. DOI: https://doi.org/10.1249/JSR.0000000000000704

Giray, L. Prompt Engineering com ChatGPT: um guia para escritores acadêmicos. Ann Biomed Eng 51 , 2629–2633 (2023). https://doi.org/10.1007/s10439-023-03272-4 DOI: https://doi.org/10.1007/s10439-023-03272-4

Lee P, Bubeck S, Petro J. Benefits, Limits, and Risks of GPT-4 as an AI Chatbot for Medicine. N Engl J Med. 2023 Mar 30;388(13):1233-1239. doi: 10.1056/NEJMsr2214184. PMID: 36988602. DOI: https://doi.org/10.1056/NEJMsr2214184

Sallam M. ChatGPT Utility in Healthcare Education, Research, and Practice: Systematic Review on the Promising Perspectives and Valid Concerns. Healthcare (Basel). 2023 Mar 19;11(6):887. doi: 10.3390/healthcare11060887. PMID: 36981544; PMCID: PMC10048148. DOI: https://doi.org/10.3390/healthcare11060887

Published

2025-01-30

Issue

Section

Award-Winning Abstracts from the Santa Catarina Congress of Academic Leagues

How to Cite

1.
Malvezzi VRT, Fantuzzi R, Mourão SDM, Canhete J, Silva FC da. DESEMPENHO DO CHATGPT 3.5 PARA RESPONDER QUESTÕES DE MÚLTIPLA-ESCOLHA EM ORTOPEDIA E TRAUMATOLOGIA. Rev. Arq Catarin Med [Internet]. 2025 Jan. 30 [cited 2026 Sep. 21];53(2):77-82. Available from: https://revista.acm.org.br/arquivos/article/view/1576

Most read articles by the same author(s)

Similar Articles

1-10 of 50

You may also start an advanced similarity search for this article.