Anthropic: la IA ha pasado de asistir en ciberataques a orquestarlos de forma autónoma

Anthropic publicó el viernes su tercer informe de inteligencia de amenazas, detallando cómo actores maliciosos intentaron weaponizar sus modelos Claude entre diciembre de 2025 y agosto de 2026, y cómo la empresa frustró esos intentos en siete categorías de daño.
La escalada más significativa documentada es el cambio en el uso de la IA en ciberataques. Mientras los casos anteriores implicaban IA asistiendo a atacantes humanos, una operación que Anthropic rastrea como GTG-20006 — con tácticas consistentes con el grupo ruso Midnight Blizzard — desplegó flujos de trabajo impulsados por IA a lo largo de toda la cadena de ataque: investigación de objetivos, infraestructura de phishing, explotación, robo de credenciales, movimiento lateral y exfiltración de datos. En un caso separado, agentes de IA monitorearon detecciones de productos de seguridad de su propio malware y reconstruyeron automáticamente el código para evadir la detección.
Intentos de armas biológicas bloqueados
Anthropic bloqueó cinco intentos de usar Claude para investigación potencial de armas biológicas, involucrando chikunguña, gripe aviar y viruela. Un caso incluyó una solicitud para redactar una solicitud de subvención para investigación gain-of-function destinada a aumentar la transmisibilidad e invasión inmune del chikunguña.
En respuesta, Anthropic restringió el acceso a sus modelos de biología más avanzados a organizaciones verificadas y compartió hallazgos con autoridades gubernamentales y socios de la industria.
Siete laboratorios chinos intentaron destilación ilícita
El informe también documenta destilación ilícita del modelo por parte de siete laboratorios de IA con sede en China. Los modelos Claude Haiku, Sonnet y Opus estuvieron involucrados en la mayoría de los casos; un caso de destilación incluyó un modelo de clase Fable o Mythos.
Más allá de las operaciones cibernéticas y las armas biológicas, el informe cubre operaciones de influencia, sistemas de vigilancia para monitorear disidentes, estafas y investigación de armas convencionales.
La advertencia más amplia
La preocupación central de Anthropic es la democratización de capacidades: a medida que los modelos de IA se vuelven más potentes, los ataques sofisticados ya no requerirán habilidades técnicas avanzadas, permitiendo a individuos solitarios intentar amenazas antes reservadas a equipos bien financiados.
Fuente: Informe de inteligencia de amenazas de Anthropic, septiembre de 2026
Publicado originalmente por Anthropic. Lee el artículo original para más detalles.
Ver fuente original