Claude Sonnet 4.6 llega con ventana de 1M tokens
Anthropic lanza Claude Sonnet 4.6 con mejoras en programación, uso del ordenador, análisis de documentos y tareas de varios pasos. Incluye una ventana de contexto de 1 millón de tokens en beta y mantiene el precio de Sonnet 4.5, desde 3 dólares por millón de tokens de entrada.

Anthropic presenta Claude Sonnet 4.6, una actualización que lleva varias capacidades que antes estaban reservadas a los modelos más caros de la compañía a una versión más rápida y económica. El modelo mejora en programación, análisis de documentos, uso de aplicaciones y tareas de varios pasos.
Sonnet 4.6 ya es el modelo predeterminado para los usuarios de los planes Free y Pro en Claude y Claude Cowork. También está disponible en Claude Code, la API, los principales servicios en la nube y todos los planes de Claude.
El precio no cambia frente a Sonnet 4.5: 3 dólares por cada millón de tokens de entrada y 15 dólares por cada millón de tokens de salida. Los tokens son las unidades de texto que el modelo procesa, por lo que el coste final depende de cuánto contexto recibe y cuánto contenido genera.
Más capacidad para trabajar con grandes volúmenes de información
La novedad más visible es una ventana de contexto de 1 millón de tokens en beta. En la práctica, esto permite introducir en una sola conversación una base de código completa, contratos extensos o decenas de artículos y documentos de investigación.
Tener más contexto no basta por sí solo. El modelo también debe encontrar las conexiones importantes dentro de todo ese material. Anthropic afirma que Sonnet 4.6 mejora en planificación a largo plazo y en tareas que requieren seguir instrucciones durante muchos pasos.
En una evaluación simulada de gestión empresarial, el modelo invirtió mucho durante los primeros diez meses para aumentar su capacidad y después cambió de estrategia para centrarse en la rentabilidad. El momento de ese cambio le permitió terminar por delante de sus competidores.
El ordenador como herramienta de trabajo
Sonnet 4.6 también mejora en el llamado uso del ordenador: puede ver una pantalla, hacer clic, escribir y navegar por programas como lo haría una persona, sin necesitar una conexión específica para cada aplicación.
Esto resulta útil en software antiguo o especializado que no ofrece una API, es decir, una forma directa de conectar otros programas con él. Algunos ejemplos son:
- Completar formularios web con varios pasos.
- Navegar por hojas de cálculo complejas.
- Trabajar en documentos repartidos entre varias pestañas.
- Usar herramientas empresariales que no fueron diseñadas para integrarse con sistemas de IA.
En la prueba OSWorld, que evalúa tareas en Chrome, LibreOffice, VS Code y otras aplicaciones, Anthropic asegura que sus modelos Sonnet han mejorado de forma sostenida durante los últimos 16 meses. La compañía también advierte que el modelo aún está por debajo de las personas más expertas y que los resultados de un benchmark no representan todo lo que ocurre en un entorno real.
Hay un riesgo importante: las páginas web pueden esconder instrucciones maliciosas para intentar manipular al modelo. Este ataque se conoce como inyección de instrucciones o prompt injection. Anthropic afirma que Sonnet 4.6 resiste mejor estos intentos que Sonnet 4.5 y que ofrece un rendimiento similar al de Opus 4.6 en sus evaluaciones.
Programación y documentos: el salto más práctico
Según las pruebas internas de Anthropic, los usuarios de Claude Code prefirieron Sonnet 4.6 frente a Sonnet 4.5 aproximadamente el 70 % de las veces. También lo eligieron frente a Claude Opus 4.5 en el 59 % de los casos.
Los usuarios señalaron que el nuevo modelo revisa mejor el contexto antes de modificar un proyecto, duplica menos código y sigue las instrucciones con más consistencia. También reportaron menos afirmaciones falsas de que una tarea estaba terminada, menos errores inventados y un mejor seguimiento de procesos largos.
En documentos empresariales, Sonnet 4.6 iguala el rendimiento de Opus 4.6 en OfficeQA, una prueba que mide si la IA puede leer gráficos, PDF y tablas, localizar datos concretos y extraer conclusiones correctas. Anthropic también recoge una mejora de 15 puntos porcentuales frente a Sonnet 4.5 en una evaluación de preguntas complejas sobre documentos empresariales realizada por Box.
La compañía afirma además que el modelo alcanzó un 94 % en su prueba de seguros, el mejor resultado que ha obtenido en esa evaluación de uso del ordenador. Son resultados comunicados por Anthropic y sus colaboradores, no una garantía de precisión para cualquier empresa o caso de uso.
Qué cambia para ti
Si usas Claude gratis, recibes un modelo más capaz sin pagar más. El nivel gratuito incorpora ahora creación de archivos, conectores, habilidades y compaction, una función que resume partes antiguas de una conversación para liberar espacio y mantener el trabajo activo durante más tiempo.
Para desarrolladores, el cambio más relevante es la relación entre capacidad y coste. Tareas como corregir errores en grandes bases de código, analizar contratos o coordinar procesos con varias herramientas pueden ejecutarse con Sonnet 4.6 sin recurrir siempre a un modelo Opus, aunque Anthropic mantiene Opus 4.6 como su opción para los problemas que exigen el razonamiento más profundo.
La API añade pensamiento adaptativo y extendido, además de compaction en beta. Sus herramientas de búsqueda web también pueden ejecutar código para filtrar los resultados y conservar solo la información relevante, lo que puede reducir el consumo de tokens.
Sonnet 4.6 no elimina la necesidad de supervisar a una IA que opera programas o toma decisiones sobre documentos. Lo que cambia es que esas tareas empiezan a ser suficientemente fiables y económicas para probarlas en más equipos. El siguiente punto a vigilar será si esa mejora se mantiene fuera de las evaluaciones controladas, en flujos de trabajo reales y con consecuencias reales.