Anthropic lanza Claude Opus 4.6 con contexto de 1M
Anthropic lanza Claude Opus 4.6 con mejoras en programación, razonamiento y tareas autónomas. El modelo incorpora una ventana de contexto de 1 millón de tokens en beta, nuevas herramientas para agentes y mantiene el precio base de la versión anterior.

Anthropic ha lanzado Claude Opus 4.6, un modelo de IA orientado a tareas complejas que mejora la programación, el análisis y el trabajo autónomo. Su principal novedad es una ventana de contexto de 1 millón de tokens en beta, suficiente para trabajar con grandes cantidades de código o documentos sin perder tantos detalles por el camino.
El modelo ya está disponible en claude.ai, la API de Anthropic y las principales plataformas cloud. El precio base se mantiene en 5 dólares por millón de tokens de entrada y 25 dólares por millón de tokens de salida.
Más capacidad para tareas largas
Opus 4.6 está diseñado para dividir trabajos complejos en pasos, usar herramientas, coordinar agentes y revisar sus propios resultados. En la práctica, puede analizar una base de código extensa, localizar el origen de un error, proponer cambios y comprobar si esos cambios funcionan.
También mejora en tareas de investigación, análisis financiero y creación de documentos, hojas de cálculo y presentaciones. Anthropic afirma que el modelo presta más atención a las partes difíciles y avanza más rápido en las tareas sencillas, aunque ese razonamiento adicional puede aumentar el tiempo y el coste en trabajos simples.
La empresa recomienda ajustar el parámetro /effort cuando el modelo esté dedicando demasiado tiempo a una tarea. Hay cuatro niveles disponibles: bajo, medio, alto, que es el predeterminado, y máximo.
El contexto de 1 millón de tokens, explicado
La ventana de contexto es la cantidad de información que un modelo puede mantener presente mientras trabaja. Con 1 millón de tokens, Opus 4.6 puede procesar documentos muy extensos, repositorios completos o conversaciones prolongadas en una sola sesión.
Anthropic asegura que el modelo conserva mejor la información relevante cuando el contexto crece. En una prueba de recuperación de datos ocultos dentro de grandes volúmenes de texto, obtuvo un 76%, frente al 18,5% de Claude Sonnet 4.5. La función está en beta y el precio premium se aplica a las solicitudes que superan los 200.000 tokens: 10 dólares por millón de tokens de entrada y 37,50 dólares por millón de salida.
La API también incorpora context compaction, una función que resume automáticamente las partes antiguas de una conversación cuando esta se acerca al límite. Así, un agente puede continuar trabajando durante más tiempo sin tener que empezar de cero.
Las cifras que presenta Anthropic
Según las evaluaciones compartidas por la compañía, Claude Opus 4.6 lidera varias pruebas de programación, búsqueda y razonamiento. Entre sus resultados destacan:
- La puntuación más alta en Terminal-Bench 2.0, una prueba de programación con herramientas.
- El primer puesto entre los modelos de frontera en Humanity’s Last Exam, una evaluación de razonamiento multidisciplinar.
- Una ventaja de alrededor de 144 puntos Elo sobre GPT-5.2 en GDPval-AA, una prueba de tareas profesionales en áreas como finanzas y derecho.
- Una ventaja de 190 puntos Elo sobre Claude Opus 4.5 en esa misma evaluación.
- El mejor resultado en BrowseComp, que mide la capacidad para encontrar información difícil de localizar en internet.
Estas cifras proceden de las pruebas descritas por Anthropic y no significan que el modelo vaya a superar a otros sistemas en cualquier tarea. Además, algunas evaluaciones utilizan herramientas externas, distintos niveles de razonamiento o configuraciones especiales.
Nuevas funciones para programadores y equipos
Claude Code, la herramienta de programación de Anthropic, incorpora equipos de agentes en vista previa de investigación. El usuario puede asignar partes de un trabajo a varios agentes que operan en paralelo, algo útil para revisar diferentes áreas de un repositorio o investigar problemas independientes.
En la API, el razonamiento adaptativo permite que Claude decida cuándo necesita pensar más antes de responder. Los desarrolladores pueden controlar ese comportamiento para equilibrar inteligencia, velocidad y coste.
Anthropic también ha actualizado Claude en Excel para que pueda planificar tareas, organizar datos sin estructura y ejecutar cambios de varios pasos. Claude en PowerPoint llega en vista previa de investigación para los planes Max, Team y Enterprise, con funciones para crear presentaciones respetando plantillas, fuentes y diseños existentes.
Más capacidad también exige más control
Anthropic afirma que Opus 4.6 mantiene un perfil de seguridad igual o mejor que el de Opus 4.5. La empresa probó comportamientos como engaño, adulación excesiva, cooperación con usos indebidos y respuestas que podrían causar daño.
El modelo también tiene mejores capacidades de ciberseguridad. Eso puede ayudar a encontrar y corregir vulnerabilidades, pero aumenta el riesgo de uso indebido. Por ese motivo, Anthropic ha creado seis nuevas pruebas para detectar respuestas peligrosas y avisa de que podría añadir intervenciones en tiempo real para bloquear abusos.
Para ti, el cambio más importante no es solo que Claude responda mejor. Es que puede trabajar durante más tiempo con menos supervisión, sobre más información y con tareas que antes había que dividir manualmente. Lo que queda por vigilar es si esa autonomía se mantiene fuera de las pruebas controladas y cuánto termina costando cuando los trabajos realmente usan todo ese contexto.