ChatGPT en medicina: usos, riesgos y límites de un modelo generalista

Descubre cómo ChatGPT puede apoyar a los médicos, sus riesgos y límites clínicos y cómo utilizarlo con seguridad en la práctica, según la OMS y el CFM.

ChatGPT en medicina: usos, riesgos y límites de un modelo generalista

Tiempo estimado de lectura: 9 minutos

Tiempo estimado de lectura: 9 minutos

¿Cómo puede un modelo de lenguaje de uso general apoyar a los médicos? ¿Cuáles son sus límites y qué hay que considerar antes de incorporarlo a la práctica clínica? El blog de Voa ha preparado una guía para explicar los usos, riesgos y límites de ChatGPT en medicina.

¿Para qué se utiliza ChatGPT en medicina?

El uso de ChatGPT en medicina puede ayudar a los médicos a organizar información, revisar contenidos y explorar hipótesis, pero no sustituye la valoración clínica humana. Su uso exige supervisión profesional, con verificación de la información generada y protección de los datos de los pacientes.

Sabemos que la inteligencia artificial generativa ha dejado de ser una tecnología de uso restringido. Hoy, los médicos y otros profesionales sanitarios utilizan herramientas como ChatGPT para resumir artículos, estructurar documentos, estudiar enfermedades, preparar materiales educativos y debatir casos clínicos.

Esta facilidad para conversar con un sistema de IA en lenguaje natural también ha planteado una cuestión más delicada: ¿hasta dónde puede participar ChatGPT en el trabajo médico?

La respuesta es: depende de la tarea.

Utilizar un modelo de lenguaje para mejorar la claridad de un texto es distinto de utilizarlo para apoyar una decisión diagnóstica. Del mismo modo, pedir una explicación sobre una enfermedad conlleva un riesgo muy diferente al de introducir datos identificables de un paciente en una plataforma externa.

La Organización Mundial de la Salud (OMS) reconoce el potencial de los grandes modelos de IA para la salud, pero recomienda desarrollar las aplicaciones médicas para tareas bien definidas, evaluando su precisión, fiabilidad, seguridad e impacto.

¿Cómo puede utilizarse ChatGPT en medicina?

El uso más seguro comienza por las actividades en las que la IA apoya el trabajo intelectual del profesional, sin asumir la decisión clínica.

Entre las posibles aplicaciones están:

  • resumir textos científicos;

  • explicar conceptos médicos;

  • comparar mecanismos fisiopatológicos;

  • estructurar información;

  • sugerir preguntas para profundizar en una investigación;

  • revisar textos y documentos;

  • preparar materiales educativos;

  • ayudar a elaborar presentaciones;

  • organizar hipótesis que el médico ya está considerando;

  • ayudar a crear contenidos para pacientes.

Estas tareas pueden parecer sencillas, pero representan una parte considerable del trabajo diario de los profesionales sanitarios.

La cuestión es establecer una frontera clara entre producir u organizar información y tomar decisiones clínicas.

¿Puede ChatGPT ayudar en el razonamiento clínico?

Sí, siempre que el médico mantenga el control del análisis.

Una posibilidad es utilizar el modelo para estructurar un caso ya evaluado, plantear preguntas que no se hayan considerado u organizar un diagnóstico diferencial para revisarlo después.

Sin embargo, el resultado debe tratarse como una sugerencia generada por un modelo de lenguaje, no como una conclusión clínica.

Esta distinción importa porque el modelo trabaja con la información que se le proporciona. Si una comorbilidad, un medicamento, una prueba o un signo clínico relevante no aparece en el texto enviado, el modelo no podrá necesariamente tenerlo en cuenta.

¿Puede ChatGPT realizar diagnósticos médicos?

Esta es una de las preguntas más frecuentes sobre el uso de ChatGPT en medicina. La respuesta es sencilla: el modelo puede generar hipótesis diagnósticas, pero eso no significa que la IA pueda sustituir el proceso diagnóstico realizado por el médico.

Un estudio publicado en PLOS ONE en 2024 evaluó ChatGPT en 150 casos clínicos de Medscape. El modelo llegó a la respuesta correcta en 74 de los 150 casos, solo el 49%. Al analizar las respuestas individualmente entre las opciones disponibles, la exactitud fue del 74%, con una sensibilidad del 49% y una especificidad del 83%. Los autores concluyeron que ChatGPT, en aquella versión y en aquel contexto, no tenía la precisión suficiente para considerarse una herramienta diagnóstica.

El estudio no significa que todas las versiones actuales de ChatGPT tengan exactamente el mismo rendimiento. Tampoco reproduce una consulta real. Su valor consiste en mostrar que un buen resultado en algunas preguntas no elimina los fallos importantes en otras.

¿Cuáles son los principales límites de ChatGPT en medicina?

Las respuestas incorrectas pueden parecer fiables

Los modelos de lenguaje pueden generar textos fluidos y bien estructurados incluso cuando la información es incorrecta. Este fenómeno se llama alucinación.

En salud, el problema puede aparecer en una explicación, una referencia bibliográfica, una recomendación o una hipótesis diagnóstica. Cuanto más convincente sea la respuesta, más difícil puede resultar detectar el error.

Un estudio publicado en Journal of Medical Internet Research en 2024 encontró tasas de referencias alucinadas del 39,6% para GPT-3.5 y del 28,6% para GPT-4 en una tarea específica de recuperación de referencias para revisiones sistemáticas. El estudio recomendó validar rigurosamente las referencias generadas por los modelos.

También está el problema de la adulación, la tendencia de ChatGPT y otros grandes modelos de lenguaje que funcionan como chatbots a dar la razón al usuario en exceso durante las interacciones, reforzando opiniones, hipótesis o decisiones que a menudo carecen de base científica.

ChatGPT puede omitir información importante

Una respuesta puede parecer completa y, aun así, omitir una hipótesis relevante. Este riesgo es especialmente importante cuando el caso depende de información que no aparece en el prompt o de signos cuya interpretación requiere experiencia clínica.

Por eso, una lista generada por ChatGPT no debe entenderse como un diagnóstico diferencial definitivo.

El contexto clínico marca la diferencia

El médico tiene en cuenta información que no siempre cabe en una pregunta para un chatbot: evolución de los síntomas, exploración física, antecedentes familiares, contexto epidemiológico, medicamentos, adherencia al tratamiento, pruebas previas y características del paciente.

El modelo solo puede trabajar con lo que recibe.

Esta limitación ayuda a explicar por qué no debe confundirse una herramienta generalista con un sistema integrado en el flujo clínico.

¿Puede utilizarse ChatGPT con datos de pacientes?

Este es uno de los aspectos más delicados de ChatGPT en medicina.

En Brasil, la LGPD clasifica los datos relativos a la salud como datos personales sensibles. La legislación establece normas específicas para su tratamiento y exige medidas de seguridad adecuadas.

Por eso, el profesional no debe limitarse a copiar una nota de evolución, una historia clínica o un informe con datos identificables en cualquier chatbot.

Antes de utilizar una herramienta con información real, es necesario evaluar:

  • cómo se procesan los datos;

  • dónde se almacena;

  • quién puede acceder a ella;

  • si puede reutilizarse;

  • qué garantías contractuales existen;

  • qué políticas institucionales se aplican;

  • si el proveedor cumple los requisitos de seguridad de la organización.

¿Qué dice el CFM sobre ChatGPT y la inteligencia artificial?

La normativa brasileña ha pasado a abordar directamente el uso médico de la IA.

La Resolución CFM nº 2.454/2026, publicada en febrero y en vigor desde el 26 de agosto de 2026, establece parámetros para el uso de la inteligencia artificial en medicina. Entre los principios destacados por el CFM está mantener la autonomía profesional: las decisiones sobre diagnóstico, pronóstico, prescripción y otros actos médicos siguen correspondiendo al médico.

La norma también permite al médico rechazar tecnologías que no considere suficientemente validadas o que no cumplan los requisitos éticos, técnicos o normativos pertinentes.

Esto establece una referencia importante para el uso de herramientas generativas: la IA puede apoyar al médico, pero no asume el acto médico.

¿Son lo mismo ChatGPT y una IA médica especializada?

No.

ChatGPT es un modelo de lenguaje de uso general. Una herramienta de IA médica especializada se desarrolla para una finalidad concreta y puede incorporar elementos específicos del entorno asistencial.

Entre ellos están:

  • fuentes científicas seleccionadas;

  • protocolos;

  • datos clínicos estructurados;

  • mecanismos de trazabilidad;

  • integración con sistemas sanitarios;

  • controles de acceso;

  • auditoría;

  • flujos de supervisión.

Esto no significa que una IA especializada sea automáticamente segura o correcta. También debe evaluarse según su finalidad. 

Charcot, el agente clínico de Voa que utiliza el contexto del paciente para apoyar el razonamiento médico, ofrecer evidencia y agilizar tareas, obtuvo el mejor resultado en un estudio científico que comparó diez grandes modelos de lenguaje (LLM) en la resolución del Exame Nacional de Avaliação da Formação Médica (ENAMED) de 2026, entre ellos ChatGPT.

¿Cómo utilizar ChatGPT en medicina con mayor seguridad?

Una guía sencilla puede reducir los riesgos:

  1. Define la tarea. Utiliza la IA con una finalidad clara.

  2. Evita los datos identificables. No envíes información de pacientes a herramientas no autorizadas.

  3. No trates la respuesta como una decisión. Utilízala como material de apoyo.

  4. Comprueba la información clínica. Consulta guías y fuentes primarias.

  5. Verifica las referencias. No des por hecho que una cita generada por la IA existe o respalda la afirmación.

  6. Considera lo que se ha omitido. Pregunta qué información haría falta para un análisis más completo.

  7. Mantén la decisión en manos del profesional.

  8. Sigue las normas de la institución.

La OMS recomienda que los sistemas de IA en salud tengan tareas bien definidas y un rendimiento adecuado en precisión y fiabilidad, además de gobernanza y supervisión.

¿Qué debe considerar el médico antes de adoptar una IA?

La pregunta no debería ser únicamente “¿qué IA es mejor?”.

Es más útil preguntar:

  • ¿Para qué tarea se desarrolló?

  • ¿En qué población se evaluó?

  • ¿Cuáles son sus principales errores?

  • ¿Qué fuentes utiliza?

  • ¿Se pueden rastrear sus respuestas?

  • ¿Cómo se protegen los datos?

  • ¿Se integra en la rutina clínica?

  • ¿Quién supervisa el resultado?

  • ¿Hay evidencia de su rendimiento en la tarea prevista?

Este enfoque desplaza el debate desde la popularidad del modelo hacia su adecuación al uso clínico.

ChatGPT en medicina: ¿dónde está el límite?

ChatGPT puede ser una herramienta útil para los profesionales sanitarios, sobre todo cuando se utiliza para organizar conocimientos, mejorar documentos, estudiar y apoyar tareas que no requieren delegar la decisión clínica.

El límite aparece cuando una respuesta generada empieza a tratarse como una autoridad.

En medicina, la información debe contextualizarse, verificarse y relacionarse con el paciente. Que una IA pueda generar una respuesta en segundos no cambia esa exigencia.

El futuro de ChatGPT en medicina probablemente tenga menos que ver con sustituir tareas médicas enteras y más con definir qué partes del trabajo pueden recibir apoyo de la IA con seguridad.

Esta distinción es importante para médicos, gestores e instituciones que deben elegir tecnologías no solo por lo que pueden producir, sino también por lo que pueden hacer con seguridad y responsabilidad.

Preguntas frecuentes (FAQ)

¿Pueden los médicos utilizar ChatGPT?

Sí. Puede apoyar el estudio, la organización de información, la elaboración de documentos y otras tareas, siempre que se respeten la privacidad, la seguridad y la supervisión profesional.

¿Puede ChatGPT diagnosticar enfermedades?

Puede generar hipótesis, pero no debe utilizarse como sustituto de la valoración médica ni como una autoridad diagnóstica autónoma.

¿Es seguro introducir datos de pacientes en ChatGPT?

Según la LGPD, los datos de salud son datos personales sensibles. Su uso depende de la herramienta, de las garantías de protección y de las políticas institucionales aplicables.

¿Sustituye ChatGPT al médico?

No. La Resolución CFM nº 2.454/2026 establece que las decisiones sobre actos médicos siguen siendo responsabilidad del profesional.

Publicado el

Tiempo de lectura: 9 minutos