IA crea cadena de exploits por $20,40, según Anthropic

By bonuz NewsroomPublished October 1, 2026
AI Built a Working Exploit Chain for $20.40, Anthropic Says

El equipo de seguridad de Anthropic asegura que un modelo de IA más barato y de acceso abierto logró construir, en menos de un día, un ataque funcional a partir de 2 fallos de software ya conocidos, por apenas $20,40. Esa cifra muestra lo asequibles que se han vuelto los ciberataques reales para cualquiera con acceso al modelo.

Qué pasó realmente

Según el Frontier Red Team de Anthropic, un investigador usó GLM-5.3-Flash, el modelo más pequeño y de pesos abiertos de la china Zhipu AI, para armar una cadena de exploits confiable a partir de 2 vulnerabilidades que ya eran públicas. El trabajo costó $20,40 a los precios de la API de Zhipu. Tomó 20 minutos de atención humana y 8 horas de trabajo del modelo, según el informe del equipo. Por separado, el fiscal general de Florida pidió a un juez estatal que impida a OpenAI ofrecer ChatGPT a menores en Florida mientras avanza su demanda contra la empresa. Esa petición es 1 de 6 prohibiciones listadas en una moción de 49 páginas para una medida cautelar temporal, presentada el 28 de septiembre. Ningún tribunal se ha pronunciado todavía sobre ninguna de las 6 solicitudes.

Cómo llegamos aquí

Armar una cadena de exploits suele llevar días de trabajo manual a especialistas entrenados. La prueba de Anthropic muestra que esa brecha se está cerrando. Las 2 fallas usadas ya eran públicas, es decir, existían parches, y aun así un modelo barato logró convertirlas en un ataque funcional. La moción de Florida no es una demanda nueva: es una solicitud dentro de un caso que el fiscal general del estado ya había presentado contra OpenAI, pidiendo a un juez que suspenda el acceso de los menores antes de que se resuelva el caso. Ninguna de las dos historias termina en una norma definitiva. Ambas muestran a instituciones tratando de alcanzar algo que ya está en movimiento.

Por qué te importa

Para cualquiera que administre software, un fallo conocido ya no es seguro solo porque exista un parche en algún lugar. Las herramientas de IA baratas permiten a los atacantes actuar antes de que la mayoría actualice nada. Para quienes desarrollan, la lección es parchear rápido y asumir que alguien ya está probando la falla antigua. Para padres y adolescentes en Florida, nada cambia por ahora. La moción es una solicitud, no un fallo, así que el acceso de los menores a ChatGPT en el estado sigue igual hasta que un juez decida. Quien dependa de productos de IA para un menor debería esperar más batallas como esta, en más estados, antes de que las reglas se asienten.

La gran pregunta

La seguridad del software ha asumido durante mucho tiempo que parchear un fallo conocido compra tiempo antes de que alguien lo explote. Si un modelo de acceso abierto puede convertir 2 fallas ya divulgadas en un ataque funcional por $20,40, ¿cuánto de esa suposición sigue en pie, y quién debería cerrar la brecha ahora que el costo de un ataque cae tanto para casi cualquiera con conexión a internet?

Qué vigilar

No se ha fijado fecha de audiencia para la moción de medida cautelar de Florida. La solicitud sigue a la espera de un fallo. El informe de Anthropic no dice si probarán la misma cadena de exploits contra modelos más grandes u otros proveedores. Quienes sigan de cerca la velocidad con que los fallos conocidos se convierten en ataques reales deberían estar atentos a la próxima actualización del Frontier Red Team de Anthropic y a la decisión del juez en el caso de Florida, lo que ocurra primero.

Keep reading