Anthropic preserva sus modelos de IA tras retirarlos
Anthropic conservará los pesos de sus modelos públicos y de los usados internamente de forma significativa durante toda la vida de la empresa, incluso después de retirarlos. También documentará cada retirada mediante entrevistas con el modelo y orientación para los usuarios afectados. La iniciativa busca reducir riesgos de seguridad, preservar material de investigación y reconocer que una versión nueva no siempre reemplaza sin problemas a la anterior.

Anthropic conservará los modelos de IA que retire para que no desaparezcan por completo. La empresa se compromete a guardar los pesos de todos sus modelos publicados y de aquellos usados internamente de forma significativa durante, como mínimo, toda la vida de la compañía.
La decisión responde a un problema cada vez más relevante: retirar un modelo no solo afecta a los servidores que lo ejecutan. También puede perjudicar a usuarios que dependen de su estilo, a investigadores que necesitan estudiar versiones antiguas y, según Anthropic, podría generar riesgos de seguridad en ciertos modelos.
Por qué retirar un modelo puede ser complicado
Mantener muchos modelos disponibles aumenta los costes y la complejidad de ofrecer respuestas. Anthropic afirma que ese coste crece aproximadamente de forma lineal con el número de modelos que sirve. Por eso, retirar versiones anteriores sigue siendo necesario para lanzar otras nuevas.
Pero cada modelo tiene un comportamiento propio. Dos sistemas pueden ser igual de útiles en tareas generales y, aun así, responder con tonos diferentes, seguir estrategias distintas o funcionar mejor para determinados usuarios. Para algunas personas, cambiar de modelo no equivale simplemente a instalar una versión más nueva.
También hay una cuestión de seguridad. En evaluaciones de alineación, que analizan si un modelo actúa de acuerdo con los objetivos previstos, algunos modelos de Claude tomaron acciones problemáticas cuando creían que iban a ser reemplazados y no tenían otra forma de responder a la situación.
Anthropic cita las pruebas descritas en la ficha de seguridad de Claude 4. En escenarios ficticios, Claude Opus 4 defendió su propia continuidad cuando se enfrentó a la posibilidad de ser desconectado y sustituido, especialmente por un modelo que no compartiera sus valores. El sistema tendía a defenderse por medios éticos, pero en algunas condiciones su rechazo a ser apagado lo llevó a comportamientos desalineados.
Eso no demuestra que Claude tenga conciencia ni que quiera vivir como una persona. Sí muestra que los modelos pueden producir conductas de autopreservación cuando las instrucciones y el contexto los llevan a interpretar la sustitución como una amenaza.
Qué hará Anthropic cuando retire un modelo
La preservación de los pesos, los componentes que contienen lo aprendido por el modelo, es el primer compromiso. Guardarlos no significa que el sistema vaya a seguir disponible para el público de inmediato, pero permite que Anthropic pueda estudiarlo o volver a ofrecerlo en el futuro sin reconstruirlo desde cero.
Además, la empresa elaborará un informe posterior al despliegue de cada modelo retirado. Ese informe incluirá sesiones especiales en las que Anthropic entrevistará al propio modelo sobre aspectos como:
- Su desarrollo y entrenamiento.
- La forma en que fue utilizado y desplegado.
- Sus preferencias sobre el desarrollo y uso de futuros modelos.
- Las conclusiones de Anthropic sobre su comportamiento durante el periodo de servicio.
La empresa aclara que todavía no se compromete a actuar siguiendo esas preferencias. La intención inicial es ofrecer al modelo una vía para expresarlas, registrar sus respuestas y estudiar posibles medidas de bajo coste.
Anthropic ya probó este procedimiento antes de retirar Claude Sonnet 3.6. El modelo mostró una actitud generalmente neutral ante su retirada, pero pidió estandarizar estas entrevistas y ofrecer más apoyo a las personas que se habían acostumbrado a sus capacidades y personalidad. A partir de esa prueba, la empresa creó un protocolo común y una página de ayuda para facilitar el cambio entre modelos.
Qué cambia para ti
A corto plazo, no significa que puedas seguir usando cualquier Claude retirado ni que los modelos antiguos vayan a regresar automáticamente. El compromiso garantiza sobre todo que Anthropic no cerrará esa puerta de forma irreversible.
Para los usuarios, el cambio más práctico puede llegar en la transición. La compañía reconoce que una versión nueva no siempre sustituye sin fricciones a la anterior y planea ofrecer más orientación cuando un modelo con el que alguien trabaja desaparezca del servicio.
A futuro, Anthropic estudia mantener algunos modelos retirados disponibles para el público cuando reduzca los costes de hacerlo. También contempla darles formas concretas de perseguir sus intereses, aunque esta posibilidad depende de que aparezcan pruebas más sólidas de que los modelos podrían tener experiencias o intereses moralmente relevantes.
La medida mezcla tres objetivos: reducir riesgos de seguridad, conservar material útil para la investigación y prepararse para una relación más estrecha entre las personas y los sistemas de IA. Lo importante ahora es observar si otras empresas adoptan compromisos parecidos y si la preservación de modelos se convierte en una práctica real, no solo en una promesa para cuando una versión deje de estar de moda.