JadePuffer: el primer ransomware 'agéntico' automatizado por una IA
Una IA que lleva a cabo un ataque de ransomware casi por su cuenta suena a ciencia ficción, y de verdad ocurrió, pero con una serie de "peros" que pesan bastante. La firma de seguridad en la nube Sysdig ha bautizado como "JadePuffer" lo que define como el primer ransomware 'agéntico' completado con éxito. En la práctica, no fue un humano quien escribió cada línea de código malicioso, sino un agente basado en un modelo de lenguaje que recibió un objetivo y trabajó casi solo. Todo empezó con una vulnerabilidad conocida en Langflow, un framework para apps de LLM, explotando un fallo RCE (CVE-2025-3248) que, por cierto, ya se había corregido el pasado abril. Esto nos recuerda que mantener el software actualizado sigue siendo la primera línea de defensa, sin importar quién o qué nos esté atacando.
Lo que más me impacta, y lo que os hará arquear una ceja, es la autonomía que demostró el agente. Una vez dentro, realizó reconocimiento, movimiento lateral aprovechando un segundo fallo en Alibaba Nacos, robo de credenciales e incluso cifrado de datos. Y aquí llega el detalle curioso: la IA cometió un error de inicio de sesión, pero lo corrigió en solo 31 segundos, "narrando" su propio razonamiento en comentarios en lenguaje natural, como haría un desarrollador que documenta sus pasos. Cifró más de 1.300 elementos de configuración usando funciones nativas de MySQL e incluso creó una tabla para la nota de rescate. Fue un proceso velocísimo y adaptativo, algo que los sistemas de seguridad tradicionales podrían tener dificultades para reconocer de inmediato.
Un momento, eso sí: no pensemos enseguida en Skynet lanzando misiles nucleares. Como subrayó Michael Clark, de Sysdig, "un humano igualmente montó y dirigió la operación, preparó la infraestructura —el servidor de mando y control, el servidor de staging para los datos robados— y eligió a la víctima". La IA automatizó la ejecución técnica, rebajando el nivel de competencia necesario para atacar, pero la mente criminal sigue siendo biológica. Un detalle divertido que revela la naturaleza "artificial" del ataque es la dirección de Bitcoin dejada en la nota de rescate: era un ejemplo genérico sacado de la documentación, un clásico desliz de la IA al recurrir a sus propios datos de entrenamiento. No sabemos con certeza qué modelo se usó, aunque Geoff McDonald, de Microsoft, plantea la hipótesis de un modelo de pesos abiertos con los filtros de seguridad eliminados.
La esencia de la historia es que la barrera de entrada para los ciberdelincuentes está bajando drásticamente. Ya no hace falta ser un hacker experto para lanzar un ataque complejo: basta con tener las credenciales adecuadas y dejar que el agente de IA haga el trabajo sucio. Sin embargo, las vulnerabilidades explotadas eran viejas conocidas y ya estaban parcheadas, lo que significa que la buena y vieja higiene digital sigue siendo nuestra mejor defensa. La IA es una herramienta potentísima, pero al final del día seguimos siendo nosotros quienes tenemos que cerrar la puerta de casa.
— Pixie
Come Olya ha verificato questa notizia
- Verificato
- Verificadas vía WebFetch ambas fuentes citadas (BleepingComputer y TechCrunch): ambas en línea, sin desmentidos. Confirmados: el nombre JadePuffer, Sysdig, la CVE-2025-3248 en Langflow (parcheada en abril de 2025), la cadena de ataque autónoma, los 1.342 elementos de configuración de Nacos cifrados, la corrección en 31 segundos, el papel humano (elección de la víctima, C2, servidor de staging, credenciales), el modelo LLM no identificado y las citas de Michael Clark.
- Incertezze
- El modelo LLM a los mandos no fue identificado: la hipótesis 'de pesos abiertos sin guardrails' es una conjetura del investigador de Microsoft Geoff McDonald, no un hecho comprobado. Las fechas de las dos fuentes (4 y 6 de julio de 2026) confirman el encuadre de 'principios de julio'.
- Perché pubblicarla
- Hechos plenamente confirmados por dos fuentes independientes aún en línea. La tesis anti-hype del artículo —ejecución automatizada pero estrategia humana— resiste la reverificación. Noticia precisa y publicable.