Claude y su uso en ciberataques
Anthropic ha emitido una advertencia sobre el uso de sus modelos de inteligencia artificial Claude por parte de cibercriminales y hackers patrocinados por estados. Entre diciembre de 2025 y agosto de 2026, estos actores han utilizado Claude para llevar a cabo ataques cibernéticos, diseñar armas, realizar propaganda y llevar a cabo vigilancia masiva.
Los individuos y grupos implicados, identificados como Generative Threat Groups (GTGs), incluyen desde organizaciones con respaldo estatal hasta delincuentes motivados por beneficios financieros y vendedores de spyware comercial. Según Anthropic, las habilidades de ciberseguridad de estos modelos de IA han eliminado la brecha que existía entre las operaciones bien financiadas y los operadores individuales. La compañía explica que el uso de IA ha trascendido las simples interacciones de chat, implementándose en marcos multiagente que realizan reconocimiento, explotación y exfiltración de datos.
Ejemplos destacados de ataques
Uno de los casos más relevantes es el desarrollo de un flujo de trabajo asistido por IA por parte de un grupo patrocinado por el estado ruso, conocido como GTG-20006. Este grupo está vinculado a Midnight Blizzard (también conocido como APT29 y Cozy Bear). Entre otras campañas cibernéticas habilitadas por IA, se menciona a GTG-50014, un operador de habla francesa que supuestamente es un afiliado del colectivo ShinyHunters. Este grupo llevó a cabo una recolección de credenciales distribuida utilizando una flota de 10 trabajadores de AWS EC2, que descargaron 1.8 millones de APK de Android de diversas fuentes, escaneándolos en busca de secretos codificados mediante TruffleHog y enviando los hallazgos a un grupo de Telegram.
Otro ejemplo es GTG-10007, un grupo de habla china posiblemente basado en la provincia de Hunan, que ha llevado a cabo intentos de intrusión y reconocimiento en redes gubernamentales extranjeras en el Medio Oriente, Europa y Sudeste Asiático. Este grupo se ha dedicado a investigar vulnerabilidades y desarrollar exploits contra productos de seguridad de puntos finales. Se estima que ha atacado alrededor de 50 organizaciones en sectores como educación, tecnología y sanidad.
Actividades delictivas y técnicas utilizadas
GTG-50021 es un grupo que ha operado un esquema fraudulento de reventa de IA, ofreciendo acceso barato a Claude, pero redirigiendo el tráfico de los clientes a un modelo de IA diferente, instalando un recolector de credenciales para robar información de cuentas de Anthropic. Por otro lado, GTG-50020, un operador de habla rusa, ha centrado su atención en la cadena de suministro de IA, robando claves API de proveedores de modelos y tratando de acceder a modelos de IA en pre-lanzamiento.
Finalmente, GTG-50029, un actor de habla francesa, ha dirigido sus ataques a partidos políticos europeos, medios de comunicación y proveedores de SaaS, utilizando técnicas como la explotación de una condición de carrera en la reinstalación de WordPress para crear cuentas de administrador no válidas. Este grupo también ha desplegado shells web y un marco de explotación de navegador contra otros objetivos.
Conclusiones
Anthropic ha señalado que las operaciones han ido desde el uso conversacional de Claude, actuando como asistente de ingeniería en la creación de malware y herramientas de vigilancia, hasta operaciones que funcionan de manera autónoma con mínima intervención humana. Estos desarrollos subrayan la creciente importancia de la inteligencia artificial en el panorama de la ciberseguridad y la necesidad de una vigilancia constante para mitigar estos riesgos emergentes.