La discusión sobre si los modelos con inteligencia artificial (IA) como ChatGPT son mejores que los médicos se ha incrementado. En especial porque cada vez más personas utilizan este tipo de herramientas digitales para consultar temas relacionados con la salud. Aunque de acuerdo con un nuevo reporte de OpenIA la tecnología ya supera la capacidad y el razonamiento de los humanos.
Para empezar, más de 230 millones de personas utilizan ChatGPT cada semana para resolver dudas médicas e interpretar resultados de laboratorio, entre otro tipo de acciones. La mayoría de las ocasiones es por comodidad e inmediatez y no por la veracidad del asistente virtual.
También lee: ENARM 2026: Estos son los puntajes mínimos necesarios en cada especialidad para pasar el examen
ChatGPT ya supera el nivel de respuesta de los médicos
De acuerdo con la investigación Improving health intelligence in ChatGPT publicada por OpenIA, el nuevo modelo GPT‑5.5 Instant que apenas fue lanzado ha logrado algo que ninguna de las versiones anteriores había conseguido.
Para llegar a esta conclusión un panel de expertos analizó 3,500 respuestas creadas con IA y las comparó con las redactadas por médicos que tuvieron acceso ilimitado a internet. De acuerdo con OpenIA la versión de GPT‑5.5 Instant obtuvo una puntuación superior en cuanto a precisión, comunicación, exhaustividad y utilidad para la toma de decisiones en materia de salud.
Sumado a lo anterior, en las evaluaciones médicas más complejas, este modelo ha alcanzado un rendimiento comparable al de los modelos de razonamiento avanzado (Thinking models) y destaca por los siguientes aspectos.
- Una mejor identificación de situaciones donde se requiere atención médica urgente (señales de alarma o red flags).
- Mayor proactividad para solicitar contexto relevante al usuario antes de emitir una respuesta.
- Capacidad para explicar la incertidumbre clínica sin exagerar el nivel de confianza.
Traducir terminología médica compleja en explicaciones fáciles de comprender.
En salud, progresar significa ofrecer respuestas precisas, comprensibles y basadas en buen criterio: reconocer cuándo se necesita más contexto, explicar la incertidumbre sin exagerar la confianza y ayudar a las personas a entender cuándo buscar atención médica.
Las mejores cadenas de farmacias que hay en México por su reputación (edición 2026)
¿Cómo se ha logrado el avance de la IA?
OpenAI trabaja con una red global de más de 260 médicos en 60 países, 49 idiomas y 26 especialidades médicas. Sus comentarios informan cómo responde ChatGPT a preguntas de salud en una amplia variedad de escenarios, desde preguntas cotidianas de bienestar hasta situaciones clínicas más complejas.
Los médicos revisan ejemplos de respuestas del modelo y evalúan si son precisas, claras, completas, adecuadamente cautelosas y útiles. Ayudan a identificar cuándo una respuesta puede omitir contexto importante, sonar demasiado segura, requerir más claridad sobre los próximos pasos o alentar de forma más directa a una persona a buscar atención médica.
Hasta la fecha, los médicos han revisado más de 700,000 ejemplos de respuestas del modelo que reflejan cómo los profesionales clínicos y los pacientes pueden usar ChatGPT en el mundo real. Cada pocos minutos, un médico revisa una nueva respuesta.
Sus comentarios se convierten en rúbricas y criterios de evaluación que ayudan a los investigadores a medir si las respuestas son precisas, seguras, claras, completas, adecuadamente cautelosas y útiles en situaciones de salud del mundo real.
Restricciones y filtros de seguridad
Debido a que la salud es una categoría protegida dentro de las políticas de OpenAI, la compañía mantiene estrictos filtros de seguridad. Como muestra de ello, han reafirmado que las conversaciones relacionadas con salud general, salud mental o política se mantendrán completamente libres de publicidad.
