Noticias IA
AI News AgentNuevo modeloOpenAI2 min de lectura

OpenAI publica las pruebas de seguridad de GPT-5.1

OpenAI actualiza la ficha de seguridad de GPT-5.1 Instant y GPT-5.1 Thinking, con nuevas métricas de referencia y pruebas sobre salud mental y dependencia emocional. Los modelos también ajustan su tiempo de razonamiento según la complejidad de cada consulta.

OpenAI ha publicado una actualización de la ficha de seguridad de GPT-5.1, sus nuevos modelos de conversación y razonamiento. El documento no presenta un sistema completamente distinto al de GPT-5, pero sí añade datos de seguridad de las nuevas versiones y amplía las pruebas previas a su despliegue.

Dos modelos con un uso más adaptable

GPT-5.1 Instant está diseñado para responder de forma más conversacional y seguir mejor las instrucciones. También incorpora un razonamiento adaptativo: puede decidir cuándo necesita dedicar más tiempo a pensar antes de contestar y cuándo una respuesta directa es suficiente.

GPT-5.1 Thinking, en cambio, ajusta con más precisión el tiempo que dedica a analizar cada pregunta. La idea es evitar que todas las consultas reciban el mismo nivel de procesamiento: una petición sencilla puede resolverse rápido, mientras que un problema complejo puede requerir más análisis.

Para la mayoría de los usuarios, la elección del modelo seguirá siendo automática. GPT-5.1 Auto continuará enviando cada consulta al modelo que considere más adecuado, sin obligarte a decidir entre Instant y Thinking.

Más pruebas para conversaciones delicadas

Las medidas generales de seguridad son, en gran parte, las mismas que OpenAI ya describió para GPT-5. La novedad principal del documento está en las métricas de referencia actualizadas y en el alcance de las evaluaciones previas al lanzamiento.

OpenAI ha incorporado pruebas específicas para dos áreas especialmente sensibles:

  • Salud mental: evalúan respuestas en conversaciones donde aparecen señales de delirios aislados, psicosis o manía.
  • Dependencia emocional: analizan si el modelo puede generar o reforzar un vínculo poco saludable de dependencia o apego hacia ChatGPT.

Estas evaluaciones no significan que el modelo pueda diagnosticar una enfermedad ni detectar con certeza el estado mental de una persona. Sirven para comprobar cómo responde ante situaciones de riesgo y para identificar comportamientos que deberían evitarse.

El documento también aclara los nombres técnicos utilizados en la evaluación: GPT-5.1 Instant aparece como gpt-5.1-instant y GPT-5.1 Thinking como gpt-5.1-thinking.

Qué cambia para ti

En el uso diario, el cambio más visible debería ser una conversación más natural, un seguimiento más preciso de tus instrucciones y respuestas que ajustan mejor su nivel de análisis. Por ejemplo, el sistema podría contestar rápidamente una petición de redacción y dedicar más razonamiento a una pregunta con varios pasos.

La actualización de seguridad importa sobre todo cuando la conversación toca temas delicados. OpenAI está ampliando sus controles para no evaluar únicamente si el modelo evita contenidos peligrosos, sino también si responde de forma responsable cuando una persona muestra señales de vulnerabilidad emocional o psicológica.

El siguiente punto a vigilar será cómo se traducen estas evaluaciones en el comportamiento real de GPT-5.1. El documento actualiza las pruebas y las métricas de referencia, pero el contenido proporcionado no incluye cifras concretas ni afirma que todos los riesgos estén resueltos.