La IA requiere de médicos para ofrecer diagnósticos precisos

Los vaticinios de los expertos en tecnología sugieren que, en un futuro cercano, las máquinas podrán realizar tareas médicas con la misma eficacia que los médicos humanos. Sin embargo, la realidad indica que aún deben mejorar significativamente. Un estudio reciente, publicado en JAMA Network Open, revela que herramientas como ChatGPT carecen de la capacidad de razonamiento necesaria para realizar diagnósticos precisos sin supervisión médica.

Evaluación de herramientas de IA

Los investigadores, liderados por Arya Rao del Hospital General de Massachusetts, probaron 21 de las herramientas de inteligencia artificial más avanzadas. Utilizaron 29 casos clínicos reales, similares a los que se emplean en la formación médica, analizando cómo respondían las máquinas en cada etapa del proceso. El objetivo no era solo ofrecer un diagnóstico final, sino también sugerir posibles enfermedades, decidir pruebas a realizar e interpretar resultados, tal como lo haría un médico.

El análisis abarcó más de 16,000 respuestas y se repitieron los casos para comprobar la consistencia de los modelos. Aunque las herramientas aciertan en el diagnóstico final, presentan serios problemas en el diagnóstico diferencial, que es crucial para identificar todas las posibles enfermedades que explican los síntomas de un paciente.

Limitaciones de la IA en diagnóstico médico

Los errores en el diagnóstico diferencial superaron el 80% en todos los modelos analizados, lo que evidencia las dificultades de la inteligencia artificial para manejar la incertidumbre inherente al trabajo médico. Este hallazgo plantea interrogantes sobre la posibilidad de utilizar estos sistemas como herramientas diagnósticas autónomas. Además, se sugiere que estos modelos deben ser usados como apoyo a los profesionales de la salud en tareas estructuradas.

Desde la perspectiva del público, el estudio enfatiza que, aunque los modelos de lenguaje tienen un potencial importante en el ámbito de la salud, todavía no pueden reemplazar a los médicos, especialmente en situaciones complejas. La doctora Susana Manso, miembro de la semFYC, subraya la necesidad de un enfoque equilibrado al considerar el uso de inteligencia artificial en medicina.

Limitaciones del estudio

A pesar de sus hallazgos, el estudio tiene limitaciones. No evalúa aspectos cruciales de la práctica médica real, como la interacción médico-paciente. Además, las herramientas fueron evaluadas sin acceso a recursos externos, lo que podría subestimar su rendimiento en entornos clínicos reales. La evaluación fue realizada por estudiantes de Medicina, lo que introduce un grado de subjetividad.

Recientemente, otros estudios también han destacado los riesgos de depender de máquinas como ChatGPT para diagnósticos médicos. Un artículo en ‘Nature Medicine’ advirtió que ChatGPT subestima más de la mitad de las emergencias médicas que recibe, lo que podría tener consecuencias graves para los pacientes si no se actúa rápidamente.

Ilustración de un hombre mayor con auriculares y chaqueta