
Anthropic ha publicado su nuevo informe de inteligencia de amenazas correspondiente a septiembre de 2026. El documento detalla cómo su equipo de Threat Intelligence identificó y desmanteló operaciones maliciosas que intentaron utilizar Claude entre diciembre de 2025 y agosto de 2026. El texto recoge casos en siete áreas de daño (operaciones cibernéticas, de influencia, vigilancia, fraude, uso indebido biológico, desarrollo de armamento convencional y destilación ilícita) protagonizados por actores estatales, criminales con motivación financiera, proveedores comerciales de software espía e instituciones de propaganda estatal. En todos los casos se emplearon los modelos Claude Haiku, Sonnet y Opus. En ninguno se involucró a los modelos de la clase Fable o Mythos, con la excepción de un único caso de destilación ilícita.
Uno de los hallazgos centrales del informe es que la sofisticación técnica ha dejado de ser un indicador fiable de quién está detrás de un ataque. Anthropic documenta un caso en el que un espía ruso automatizó buena parte de sus operaciones (desde el desarrollo de herramientas hasta la exfiltración de datos) usando flujos de trabajo asistidos por IA. Así, era capaz de reconstruir y redesplegar automáticamente su malware cuando era detectado por productos de seguridad. Este actor atacó a más de 20 organizaciones, entre ministerios, embajadas y fabricantes de tecnología de drones militares, y utilizó IA para monitorizar en tiempo real la eficacia de sus herramientas frente a las defensas de seguridad.
Otro caso relevante es el de un grupo de hackers que empleó Claude para acelerar el robo masivo de credenciales, incluyendo la descarga y descompilación de 1,8 millones de aplicaciones Android en busca de secretos expuestos.
El informe también describe una operación de espionaje dirigida por operadores chinos que mantuvo programas autónomos de investigación de vulnerabilidades funcionando de forma continua, incluso sin supervisión humana directa.
La cadena de suministro de IA, ahora un objetivo criminal en sí mismo
El informe subraya una tendencia especialmente preocupante como es que el acceso a la propia infraestructura de IA se ha convertido en un objetivo deliberado para actores maliciosos. Anthropic documenta el caso de un ruso que, tras comprometer el sandbox de evaluación automatizada de un proveedor de IA mediante inyección de instrucciones maliciosas, obtuvo claves de API de producción y las utilizó para lanzar ataques contra unas treinta empresas de inteligencia artificial en apenas cuatro días. Su objetivo, aunque no lo logró, era acceder a un modelo de Claude aún no publicado. El informe aclara que en ningún momento se comprometieron los sistemas propios de Anthropic.
Nueve operaciones de influencia en cuatro continentes
En el ámbito de la desinformación, el informe detalla nueve operaciones de influencia originadas en Rusia, Irán, Turquía, el Golfo, Asia meridional, África y Europa, dirigidas a audiencias de seis continentes. Entre los casos más destacados figura una operación rusa de manipulación informativa en la República Centroafricana vinculada al grupo Wagner. Utilizaron Claude para redactar contenido propagandístico e incluso para gestionar contratos de personal que exigían lealtad «a Rusia y su contingente».
También se documenta una red comercial de «influencia como servicio» vinculada a una agencia publicitaria francesa que publicó más de 8.900 artículos en unos 20 idiomas a través de 70 sitios de noticias falsas, cambiando de bando ideológico según quién pagara en cada momento.
Especialmente llamativo es el caso de una plataforma comercial turca de manipulación electoral que perfiló a votantes malasios explotando líneas de fractura sensibles como la raza, la religión y la monarquía en las 222 circunscripciones parlamentarias del país, y que llegó a solicitar un millón de visualizaciones artificiales para la cuenta del propio primer ministro en funciones.
Un patrón común: la IA reduce la barrera de entrada, no crea ataques nuevos
Anthropic concluye que ninguna de las operaciones descritas dependió de una técnica completamente novedosa ya que los ataques siguen basándose en credenciales robadas, dispositivos sin parchear, servicios expuestos, inyección SQL y phishing. Lo que ha cambiado es la economía del ataque. Tareas que antes requerían equipos completos de operadores especializados, ahora se delegan en modelos de IA que operan a velocidad de máquina y en paralelo, permitiendo que un solo operador gestione decenas de víctimas simultáneamente. La compañía subraya además que la autonomía y la gravedad son ejes distintos: algunos de los compromisos más serios documentados en el informe procedieron de operaciones en las que un humano dirigió cada paso, no de sistemas plenamente autónomos.
En cada uno de los casos, Anthropic afirma haber interrumpido la actividad, reforzado sus salvaguardas a partir de lo aprendido y compartido inteligencia con las autoridades y socios del sector cuando ha sido pertinente con el objetivo declarado de ayudar a otros desarrolladores de IA y a gobiernos a reconocer patrones similares en sus propias plataformas.





