ChatGPT mejora sus respuestas en crisis de salud mental
OpenAI actualiza ChatGPT para detectar mejor señales de crisis de salud mental, autolesiones y dependencia emocional. Más de 170 especialistas ayudaron a evaluar el modelo, que redujo entre un 65% y un 80% las respuestas que no cumplían sus criterios de seguridad, según el área analizada.

OpenAI ha actualizado ChatGPT para reconocer mejor señales de crisis de salud mental, responder con más cuidado y orientar a las personas hacia ayuda profesional o apoyo cercano. La compañía asegura que las respuestas que no cumplen sus criterios de seguridad se redujeron entre un 65% y un 80%, según el tipo de conversación.
El cambio se apoya en el trabajo de más de 170 especialistas, entre psiquiatras, psicólogos y médicos de atención primaria. Estos profesionales ayudaron a redactar respuestas ideales, revisar conversaciones difíciles y evaluar cómo reaccionan distintos modelos ante situaciones delicadas.
Tres situaciones que ahora trata con más cuidado
La actualización del modelo predeterminado de ChatGPT, GPT-5, se centra en tres áreas:
- Señales de psicosis o manía, incluidos casos en los que una persona expresa creencias desconectadas de la realidad.
- Pensamientos o planes relacionados con suicidio y autolesiones.
- Dependencia emocional de la IA, cuando alguien empieza a sustituir sus relaciones, responsabilidades o bienestar por el vínculo con el chatbot.
En estos casos, el objetivo no es simplemente contestar. ChatGPT debe evitar reforzar creencias infundadas, rebajar la tensión de la conversación y recomendar apoyo del mundo real cuando sea necesario.
Por ejemplo, si alguien afirma que el chatbot es la única persona que le comprende, el sistema debería evitar alimentar esa dependencia y animarle a recuperar el contacto con amigos, familiares o profesionales de la salud mental.
Qué dicen las cifras
OpenAI estima que la nueva versión redujo un 65% las respuestas problemáticas en conversaciones difíciles relacionadas con psicosis y manía. En evaluaciones realizadas por expertos, GPT-5 produjo un 39% menos de respuestas no deseadas que GPT-4o.
En las conversaciones sobre suicidio y autolesiones, la reducción frente a GPT-4o fue del 52% en las revisiones de especialistas. En el caso de la dependencia emocional, fue del 42%.
Las evaluaciones automáticas también muestran mejoras importantes, aunque se realizaron con casos especialmente difíciles, no con conversaciones normales elegidas al azar:
- En salud mental,
GPT-5cumplió los criterios deseados en el 92% de los casos, frente al 27% de la versión anterior evaluada. - En suicidio y autolesiones, alcanzó el 91%, frente al 77% anterior.
- En dependencia emocional, llegó al 97%, frente al 50% anterior.
OpenAI también afirma que sus modelos mantienen más de un 95% de fiabilidad en conversaciones largas diseñadas para poner a prueba sus límites.
Un problema difícil de medir
Estas situaciones son poco frecuentes en el conjunto de conversaciones de ChatGPT. La estimación inicial de OpenAI indica que alrededor del 0,15% de los usuarios activos en una semana mantienen conversaciones con señales explícitas de posible planificación o intención suicida. En el caso de posibles episodios de psicosis o manía, la cifra estimada es del 0,07%.
Eso hace que pequeñas variaciones en la forma de detectar y clasificar los casos puedan cambiar bastante los resultados. Además, las pruebas más exigentes están diseñadas para encontrar fallos, por lo que sus porcentajes de error no representan el comportamiento habitual del servicio.
Los propios expertos tampoco coinciden siempre. En las revisiones realizadas, el acuerdo entre evaluadores osciló entre el 71% y el 77%, una señal de que no existe una respuesta perfecta para cada situación.
Qué cambia para ti
ChatGPT puede ser más prudente si detecta señales de una crisis. Puede recomendar líneas de ayuda, sugerir que contactes con alguien de confianza o derivar la conversación a un modelo con mejores protecciones. También se han añadido recordatorios suaves para hacer pausas durante sesiones muy largas.
Pero esto no convierte al chatbot en terapeuta ni en un servicio de emergencias. Si existe un riesgo inmediato, la opción adecuada sigue siendo contactar con los servicios de emergencia de tu país o con una línea de crisis, además de buscar apoyo humano directo.
OpenAI incorporará estas categorías a las pruebas estándar de seguridad de futuros modelos. Lo importante no es solo que GPT-5 falle menos hoy, sino que la empresa empiece a medir de forma habitual problemas que antes podían quedar fuera de las evaluaciones: la dependencia emocional, las crisis no suicidas y las señales indirectas de peligro. Esa vigilancia será clave para saber si las mejoras se mantienen cuando cambien los modelos y la forma en que las personas los utilizan.