Em Alta Eleições 2026 PolíticaNotíciasAcontecimentos internacionaisPessoasConflitoseconomiaFutebol

Converse com o Telinha

Telinha
Oi! Posso responder perguntas apenas com base nesta matéria. O que você quer saber?

IA erra diagnóstico inicial de pacientes em mais de 80% dos casos, aponta estudo

Inteligência artificial falha em diagnóstico diferencial adequado em oitenta por cento dos casos, mantendo a supervisão humana essencial

Study suggests AI chatbots are not ready for frontline clinical use.
0:00
Carregando...
0:00

Um estudo mostra que modelos de IA de linguagem falham na geração de diagnósticos diferenciais precoces em mais de 80% dos casos, sugerindo que não estão prontos para uso clínico não supervisionado. A pesquisa envolve modelos amplos de IA aplicados a cenários clínicos simulados.

Pesquisadores do Mass General Brigham, grande rede hospitalar de Boston, avaliaram 21 LLMs, incluindo Claude, GPT, Gemini e Grok, em 29 vinhetas clínicas padronizadas. O objetivo foi medir habilidades de raciocínio médico em etapas diferentes.

Metodologia e cenário de teste

Os modelos foram testados com informações progressivas: idade, sexo, sintomas, exame físico e resultados de laboratório. Um instrumento próprio, o PrIME-LLM, avaliou diagnóstico inicial, pedidos de exames, diagnóstico final e planejamento de tratamento.

Os resultados mostraram alto acerto no diagnóstico final, mas desempenho fraco para o passo crítico de criar um diagnóstico diferencial. A variabilidade entre modelos foi grande conforme o conjunto de dados.

Principais implicações

Autores ressaltam que, mesmo com avanços, IA comercial não está pronta para implantação clínica sem supervisão humana constante. O estudo enfatiza a necessidade de intervenção clínica humana na tomada de decisões.

Especialistas externos destacam a importância do julgamento humano. Embora as IA possam auxiliar, o veredito final em saúde não deve depender apenas de máquinas. Consultas com profissionais continuam essenciais.

Destaques e próximos passos

Entre os modelos mais promissores, destacam-se Grok 4, GPT-5, GPT-4.5, Claude 4.5 Opus e Gemini 3.0. Os pesquisadores sugerem que melhorias devem priorizar raciocínio clínico estruturado e manejo de incertezas.

Comentários 0

Entre na conversa da comunidade

Os comentários não representam a opinião do Portal Tela; a responsabilidade é do autor da mensagem. Conecte-se para comentar

Veja Mais