Anthropic revela los casos más llamativos del uso criminal que se ha tratado de dar a Claude en los últimos meses

Anthropic ha publicado su nuevo informe de inteligencia de amenazas correspondiente a septiembre de 2026. El documento detalla cómo su equipo de Threat Intelligence identificó y desmanteló operaciones maliciosas que intentaron utilizar Claude entre diciembre de 2025 y agosto de 2026. El texto recoge casos en siete áreas de daño (operaciones cibernéticas, de influencia, vigilancia, fraude, uso indebido biológico, desarrollo de armamento convencional y destilación ilícita) protagonizados por actores estatales, criminales con motivación financiera, proveedores comerciales de software espía e instituciones de propaganda estatal. En todos los casos se emplearon los modelos Claude Haiku, Sonnet y Opus. En ninguno se involucró a los modelos de la clase Fable o Mythos, con la excepción de un único caso de destilación ilícita.

Uno de los hallazgos centrales del informe es que la sofisticación técnica ha dejado de ser un indicador fiable de quién está detrás de un ataque. Anthropic documenta un caso en el que un espía ruso automatizó buena parte de sus operaciones (desde el desarrollo de herramientas hasta la exfiltración de datos) usando flujos de trabajo asistidos por IA. Así, era capaz de reconstruir y redesplegar automáticamente su malware cuando era detectado por productos de seguridad. Este actor atacó a más de 20 organizaciones, entre ministerios, embajadas y fabricantes de tecnología de drones militares, y utilizó IA para monitorizar en tiempo real la eficacia de sus herramientas frente a las defensas de seguridad.

Otro caso relevante es el de un grupo de hackers que empleó Claude para acelerar el robo masivo de credenciales, incluyendo la descarga y descompilación de 1,8 millones de aplicaciones Android en busca de secretos expuestos.

El informe también describe una operación de espionaje dirigida por operadores chinos que mantuvo programas autónomos de investigación de vulnerabilidades funcionando de forma continua, incluso sin supervisión humana directa.

La cadena de suministro de IA, ahora un objetivo criminal en sí mismo

El informe subraya una tendencia especialmente preocupante como es que el acceso a la propia infraestructura de IA se ha convertido en un objetivo deliberado para actores maliciosos. Anthropic documenta el caso de un ruso que, tras comprometer el sandbox de evaluación automatizada de un proveedor de IA mediante inyección de instrucciones maliciosas, obtuvo claves de API de producción y las utilizó para lanzar ataques contra unas treinta empresas de inteligencia artificial en apenas cuatro días. Su objetivo, aunque no lo logró, era acceder a un modelo de Claude aún no publicado. El informe aclara que en ningún momento se comprometieron los sistemas propios de Anthropic.

Nueve operaciones de influencia en cuatro continentes

En el ámbito de la desinformación, el informe detalla nueve operaciones de influencia originadas en Rusia, Irán, Turquía, el Golfo, Asia meridional, África y Europa, dirigidas a audiencias de seis continentes. Entre los casos más destacados figura una operación rusa de manipulación informativa en la República Centroafricana vinculada al grupo Wagner. Utilizaron Claude para redactar contenido propagandístico e incluso para gestionar contratos de personal que exigían lealtad «a Rusia y su contingente».

También se documenta una red comercial de «influencia como servicio» vinculada a una agencia publicitaria francesa que publicó más de 8.900 artículos en unos 20 idiomas a través de 70 sitios de noticias falsas, cambiando de bando ideológico según quién pagara en cada momento.

Especialmente llamativo es el caso de una plataforma comercial turca de manipulación electoral que perfiló a votantes malasios explotando líneas de fractura sensibles como la raza, la religión y la monarquía en las 222 circunscripciones parlamentarias del país, y que llegó a solicitar un millón de visualizaciones artificiales para la cuenta del propio primer ministro en funciones.

Un patrón común: la IA reduce la barrera de entrada, no crea ataques nuevos

Anthropic concluye que ninguna de las operaciones descritas dependió de una técnica completamente novedosa ya que los ataques siguen basándose en credenciales robadas, dispositivos sin parchear, servicios expuestos, inyección SQL y phishing. Lo que ha cambiado es la economía del ataque. Tareas que antes requerían equipos completos de operadores especializados, ahora se delegan en modelos de IA que operan a velocidad de máquina y en paralelo, permitiendo que un solo operador gestione decenas de víctimas simultáneamente. La compañía subraya además que la autonomía y la gravedad son ejes distintos: algunos de los compromisos más serios documentados en el informe procedieron de operaciones en las que un humano dirigió cada paso, no de sistemas plenamente autónomos.

En cada uno de los casos, Anthropic afirma haber interrumpido la actividad, reforzado sus salvaguardas a partir de lo aprendido y compartido inteligencia con las autoridades y socios del sector cuando ha sido pertinente con el objetivo declarado de ayudar a otros desarrolladores de IA y a gobiernos a reconocer patrones similares en sus propias plataformas.

Noticias Relacionadas

Un ciberataque con IA compromete las webs de Adif y Renfe durante varios días
  • septiembre 26, 2026

Una organización criminal utiliza un sistema de inteligencia artificial para atacar durante varios días las webs de Adif y Renfe, accediendo a la nube corporativa y sustrayendo 500 GB de datos, en un caso ya trasladado al CCN-CERT.

Seguir Leyendo...
Javier García, primer español en el órgano de gobierno del Consejo Mundial de Ciencia
  • septiembre 25, 2026

El catedrático de la Universidad de Alicante Javier García ha sido elegido miembro del órgano de gobierno del International Science Council, convirtiéndose en el primer español en formar parte de la dirección de esta organización científica internacional.

Seguir Leyendo...

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *