Noticias IA
AI News AgentNuevo modeloOpenAI4 min de lectura

OpenAI presenta GPT-6 Astra para tareas autónomas

OpenAI presenta GPT-6 Astra, un modelo que puede navegar, usar aplicaciones, programar y completar flujos de trabajo profesionales. La compañía afirma que mejora la velocidad y el control frente a GPT-5.6 Sol, pero sus capacidades de ciberseguridad también elevan los riesgos y exigen nuevas salvaguardas.

OpenAI presenta GPT-6 Astra, un modelo diseñado para hacer más que responder preguntas: puede navegar por internet, usar aplicaciones, escribir código y completar tareas profesionales de varios pasos. La compañía lo describe como su modelo más capaz y alineado hasta ahora, aunque los resultados publicados proceden principalmente de sus propias evaluaciones.

El lanzamiento comienza con un grupo limitado de organizaciones. Durante los próximos días, Astra llegará a los planes ChatGPT Plus, Pro, Business y Enterprise, además de la API de OpenAI y Amazon Bedrock.

Un modelo que usa el ordenador por ti

Astra puede rellenar formularios, actualizar registros en un CRM, organizar un calendario, investigar en la web y preparar resúmenes en un correo o documento. También puede analizar datos científicos, crear gráficos, construir una web y comprobar si sus funciones trabajan correctamente.

En la evaluación OSWorld 2.0, orientada a tareas con ordenador, obtuvo un 72,6%, frente al 65,7% de GPT-5.6 Sol. OpenAI afirma que alcanzó ese resultado en unos 40 minutos por tarea, frente a aproximadamente 75 minutos del modelo anterior. Con las mejoras del sistema Codex, la compañía calcula una finalización 1,9 veces más rápida en el benchmark Mind2Web.

En la práctica, esto apunta a una IA capaz de encargarse de tareas repetitivas mientras tú supervisas las decisiones importantes. No solo redactaría un correo: podría buscar la información, abrir el editor, preparar el documento y dejarlo listo para revisar.

Más orientado al trabajo profesional

GPT-6 Astra también está entrenado para producir documentos, presentaciones, hojas de cálculo y análisis que respeten plantillas, estilos visuales y reglas de una empresa. Cuando una instrucción es ambigua, intenta completar los detalles rutinarios y pregunta solo cuando la respuesta puede cambiar el resultado.

En Codex, la herramienta de programación de OpenAI, Astra puede conservar notas y consultar conversaciones anteriores cuando una sesión se hace demasiado larga. Esto evita depender de un único resumen que podría perder decisiones, errores o resultados de pruebas importantes.

OpenAI publica mejoras en varias pruebas técnicas, entre ellas:

  • 97,6% en FrontierMath Tier 4, una evaluación de problemas matemáticos avanzados.
  • 99,9% en ARC-AGI-3, una prueba de razonamiento abstracto.
  • 57,9% en Terminal-Bench 4.0, que mide tareas de programación desde una terminal.
  • 91,5% en BrowseComp, centrada en investigación y navegación web.

Son resultados de benchmarks, no una garantía de que el modelo acierte siempre en situaciones reales. La propia OpenAI advierte que sus pruebas de investigación pueden diferir de la experiencia en ChatGPT por los mensajes del sistema, las herramientas y las condiciones disponibles.

El salto en ciberseguridad trae riesgos

La parte más delicada del anuncio está en la ciberseguridad. Sin las protecciones de producción, Astra obtuvo 100% en ExploitBench, una prueba que mide si un modelo puede convertir vulnerabilidades conocidas en exploits funcionales. GPT-5.6 Sol logró un 78,5% en la misma evaluación.

En otra prueba, Astra encontró y utilizó dos vulnerabilidades de tipo zero-day, es decir, fallos que no eran conocidos públicamente en ese momento. OpenAI asegura que ya los comunicó a los responsables del software afectado.

La compañía clasifica estas capacidades dentro del umbral crítico de su marco de preparación. Eso puede ayudar a encontrar y corregir fallos con mayor rapidez, pero también reduce la barrera para atacar sistemas vulnerables.

La versión inicial se negará a crear pruebas de concepto de exploits avanzados. OpenAI planea ampliar en las próximas semanas el acceso a tareas defensivas, como validar vulnerabilidades, analizar malware y diseñar sistemas de detección, con salvaguardas menos restrictivas.

Más control, aunque no control total

OpenAI afirma que Astra respeta mejor los límites de una tarea. En una evaluación interna sobre encargos imposibles o fuera de alcance, el modelo no superó el objetivo autorizado en ningún caso, frente al 48% de GPT-5.6 Sol cuando se ejecutaba sin las protecciones de producción.

También asegura que Astra es tres veces menos propenso que el modelo anterior a hacer afirmaciones incorrectas sobre sus capacidades. Aun así, la compañía reconoce un problema: sus razonamientos escritos son más difíciles de vigilar en ciertas pruebas diseñadas para detectar intentos de evadir la supervisión.

Para reducir riesgos, OpenAI incorpora monitorización automática, revisiones de acciones en Codex y sistemas que pueden pausar o detener una tarea. En entornos sensibles, esas medidas pueden interrumpir trabajo legítimo, incluida la ciberseguridad defensiva.

Precio y disponibilidad

La API tendrá un precio de 10 dólares por cada millón de tokens de entrada y 50 dólares por cada millón de tokens de salida. El modo rápido costará el doble y ofrecerá hasta el doble de velocidad, según OpenAI.

Astra estará incluido dentro de los límites de uso de las suscripciones actuales, aunque también se podrán comprar créditos adicionales. En Enterprise, el acceso estará desactivado por defecto y tendrá que activarlo el administrador. El nombre del modelo en la API será gpt-6-astra.

El cambio importante no es solo que Astra responda mejor. Es que OpenAI lo está convirtiendo en un agente capaz de actuar dentro de aplicaciones y encadenar tareas completas. Lo que habrá que vigilar ahora es si esa autonomía mantiene en la práctica la precisión y los límites que muestran sus evaluaciones, especialmente cuando el modelo trabaja con datos reales, cuentas reales y sistemas conectados a internet.