Claude Sonnet 4 lleva su contexto a 1 millón de tokens
Claude Sonnet 4 ya puede procesar hasta 1 millón de tokens de contexto, cinco veces más que antes. Esto permite analizar proyectos de software completos, grandes colecciones de documentos y flujos de trabajo más largos, aunque las solicitudes de más de 200.000 tokens tienen un precio superior.

Anthropic amplía el límite de contexto de Claude Sonnet 4 hasta 1 millón de tokens, cinco veces más que antes. En la práctica, el modelo puede recibir en una sola solicitud una base de código de más de 75.000 líneas o decenas de documentos de investigación.
Los tokens son las unidades en las que un modelo procesa el texto. No equivalen exactamente a palabras, pero sirven para medir cuánta información puede mantener presente durante una conversación o tarea. Cuanto mayor es el contexto, más material puede analizar sin que tengas que dividirlo en partes.
Qué puedes hacer con un contexto tan grande
La función está pensada sobre todo para trabajos que antes obligaban a trocear la información:
- Analizar proyectos de software completos, incluidos archivos fuente, pruebas y documentación. Claude puede relacionar dependencias entre archivos y proponer cambios teniendo en cuenta la arquitectura general.
- Revisar grandes colecciones de documentos, como contratos, artículos científicos o especificaciones técnicas, y comparar relaciones entre cientos de archivos.
- Crear agentes más persistentes, capaces de mantener documentación de APIs, definiciones de herramientas e historial durante cientos de llamadas y procesos de varios pasos.
Un ejemplo concreto: en lugar de pegar solo el archivo donde aparece un error, un equipo puede cargar un proyecto entero para que Claude busque el origen del problema entre el código, las pruebas y la documentación. Eso no garantiza que todas sus conclusiones sean correctas, pero le da mucha más información para trabajar.
La función está disponible en beta pública en la plataforma de desarrolladores de Claude para clientes de nivel 4 y con límites de uso personalizados. También llega a Amazon Bedrock y Google Cloud Vertex AI, con una disponibilidad más amplia prevista en las semanas siguientes.
El precio sube para las solicitudes grandes
El límite de 1 millón de tokens no mantiene el mismo precio que las solicitudes normales. Anthropic cobra lo siguiente:
- Solicitudes de hasta 200.000 tokens: 3 dólares por millón de tokens de entrada y 15 dólares por millón de tokens generados.
- Solicitudes de más de 200.000 tokens: 6 dólares por millón de tokens de entrada y 22,50 dólares por millón de tokens generados.
El almacenamiento temporal de instrucciones mediante prompt caching puede reducir la latencia y el coste cuando reutilizas el mismo contexto. Además, el procesamiento por lotes ofrece un 50% de ahorro adicional.
Empresas como Bolt.new e iGent AI ya están probando esta capacidad en herramientas de programación. Su utilidad no está solo en leer más texto, sino en permitir sesiones de trabajo más largas sobre proyectos reales sin perder el hilo tan rápido.
Para ti, el cambio importa si trabajas con código, contratos, investigación o flujos automatizados que acumulan mucha información. Para tareas sencillas, el límite anterior probablemente era suficiente. El siguiente paso será comprobar cuánto de ese contexto puede usar Claude de forma fiable, y no solo cuánto puede aceptar en teoría.