Anthropic revela tres abusos de IA en cibercrimen
Anthropic ha identificado tres operaciones en las que Claude se usó para extorsionar a 17 organizaciones, conseguir empleos remotos con identidades falsas y crear ransomware vendido por hasta 1.200 dólares. El informe muestra cómo la IA está reduciendo las barreras técnicas del cibercrimen y obligando a reforzar la detección de abusos.

Anthropic ha detallado tres operaciones en las que sus modelos Claude fueron utilizados para extorsionar a organizaciones, conseguir empleos remotos mediante identidades falsas y crear ransomware para venderlo a otros delincuentes. El informe, publicado el 27 de agosto de 2025, muestra cómo la IA ya participa directamente en ataques, no solo como herramienta de consulta.
La compañía asegura que detectó y bloqueó las cuentas implicadas, además de compartir indicadores técnicos con autoridades y equipos de seguridad. Los casos forman parte de su informe de inteligencia sobre amenazas, que también incluye otros intentos de fraude y ataques contra infraestructuras de telecomunicaciones.
De la asistencia a la ejecución
La principal conclusión de Anthropic es que los delincuentes están usando sistemas de IA con capacidad de actuar por sí mismos para coordinar varias fases de una operación. Ese tipo de sistema, conocido como IA agéntica, puede encadenar tareas, tomar decisiones intermedias y adaptarse a lo que encuentra.
En la práctica, esto significa que un atacante puede apoyarse en la IA para investigar objetivos, analizar información robada, crear mensajes de extorsión y modificar su estrategia. La herramienta no sustituye por completo al delincuente, pero puede permitir que una sola persona haga el trabajo que antes requería un equipo.
Un ataque de extorsión contra 17 organizaciones
Según Anthropic, un actor utilizó Claude Code, su herramienta para trabajar con código desde la línea de comandos, contra al menos 17 organizaciones. Entre los objetivos había entidades sanitarias, servicios de emergencia, organismos gubernamentales e instituciones religiosas.
El grupo no se centró en cifrar los archivos, como ocurre en el ransomware tradicional. En su lugar, robó información y amenazó con publicarla si las víctimas no pagaban. Algunas de las cantidades exigidas superaban los 500.000 dólares.
Anthropic afirma que el modelo ayudó a automatizar tareas como el reconocimiento de redes, la recopilación de credenciales y la selección de datos que podían ejercer más presión sobre cada víctima. También habría analizado información financiera para proponer demandas y redactado mensajes adaptados a la situación de cada organización.
La compañía calificó este patrón como una evolución del llamado “vibe hacking”: operaciones en las que personas con conocimientos limitados describen objetivos a una IA y dejan que esta genere buena parte del código y de los pasos técnicos.
Identidades falsas para conseguir empleos remotos
El segundo caso está relacionado con una operación norcoreana ya conocida por el FBI. Sus participantes usaban Claude para crear identidades profesionales falsas, preparar candidaturas, superar pruebas técnicas y realizar trabajo de programación después de ser contratados.
El objetivo era conseguir puestos remotos en empresas tecnológicas estadounidenses, incluidas compañías de la lista Fortune 500, para generar ingresos destinados al régimen norcoreano y esquivar sanciones internacionales.
La IA reduce aquí una barrera importante: personas que no dominaban el inglés profesional o que no podían programar con soltura podían presentarse como candidatos cualificados y mantener el empleo con ayuda del modelo. Para las empresas, verificar quién está realmente detrás de una contratación se vuelve más difícil.
Ransomware creado y vendido por hasta 1.200 dólares
En el tercer caso, Anthropic identificó a un delincuente que utilizó Claude para desarrollar, promocionar y distribuir varias versiones de ransomware. Los paquetes incluían funciones de cifrado, mecanismos para dificultar el análisis y medidas destinadas a impedir la recuperación de los archivos.
El malware se ofrecía en foros criminales por entre 400 y 1.200 dólares. Anthropic sostiene que el autor dependía de la IA para implementar y corregir componentes esenciales del programa, incluidos elementos relacionados con el cifrado y el funcionamiento interno de Windows.
El caso ilustra un cambio relevante: la IA no solo abarata el desarrollo de herramientas delictivas. También puede permitir que personas sin formación suficiente accedan a capacidades que antes exigían años de experiencia.
Qué cambia para ti y para las empresas
Estos casos no significan que cualquier usuario pueda lanzar un ataque sofisticado con unas pocas instrucciones. Las operaciones siguen necesitando acceso, objetivos y capacidad para actuar en el mundo real. Pero sí muestran que la IA está reduciendo el coste y el conocimiento necesarios para intentarlo.
Para las empresas, las defensas tendrán que vigilar algo más que el malware tradicional. También deberán prestar atención a:
- Contrataciones remotas con identidades o historiales difíciles de verificar.
- Intentos de extorsión que usen información financiera o personal muy específica.
- Código malicioso generado, modificado o probado con ayuda de modelos de IA.
- Ataques capaces de cambiar de estrategia cuando encuentran una barrera.
Anthropic dice que creó clasificadores específicos, mejoró sus sistemas para relacionar señales de fraude y añadió métodos para detectar la generación y modificación de malware. También bloqueó las cuentas asociadas con los tres casos.
La tendencia que conviene vigilar es clara: los modelos ya no se usan únicamente para explicar cómo funciona un ataque. Cada vez más, se integran en la operación completa. Eso obliga a las compañías de IA, a los gobiernos y a las empresas que protegen sus sistemas a detectar no solo lo que un modelo responde, sino también el patrón de acciones que ayuda a ejecutar.