A equipe de segurança da Anthropic afirma que um modelo de IA mais barato e aberto montou, em menos de um dia, um ataque funcional explorando 2 falhas de software já conhecidas — tudo por US$ 20,40. O valor mostra o quanto ataques cibernéticos reais já ficaram acessíveis para quem tem acesso ao modelo.
O que realmente aconteceu
Segundo o Frontier Red Team da Anthropic, um pesquisador usou o GLM-5.3-Flash, versão menor e de pesos abertos da chinesa Zhipu AI, para construir uma cadeia de exploit confiável a partir de 2 falhas que já eram públicas. O trabalho custou US$ 20,40 nos preços da API da Zhipu. Segundo o relatório da equipe, foram 20 minutos de atenção humana e 8 horas de processamento do modelo. Em paralelo, o procurador-geral da Flórida pediu a um juiz estadual que impeça a OpenAI de oferecer o ChatGPT a menores no estado enquanto seu processo contra a empresa segue em andamento. Esse pedido é 1 de 6 proibições listadas em uma moção de 49 páginas por uma liminar, protocolada eletronicamente em 28 de setembro. Nenhum dos 6 pedidos foi julgado até agora.
Como chegamos aqui
Cadeias de exploit costumam exigir dias de trabalho manual de especialistas treinados. O teste da Anthropic mostra essa distância encolhendo. As 2 falhas usadas já eram públicas, ou seja, já existiam correções disponíveis, e ainda assim um modelo barato conseguiu transformá-las em um ataque funcional. A moção da Flórida não é um processo novo: é um pedido dentro de uma ação que o procurador-geral do estado já havia movido contra a OpenAI, buscando suspender o acesso de menores antes mesmo do julgamento final. Nenhuma das duas histórias chega a uma decisão definitiva. Ambas mostram instituições tentando alcançar algo que já está em movimento.
Por que isso importa para você
Para quem administra software, uma falha conhecida deixou de ser segura só porque existe uma correção disponível em algum lugar. Ferramentas de IA baratas permitem que atacantes ajam antes que a maioria das pessoas atualize qualquer coisa. Para desenvolvedores, a lição é corrigir rápido e assumir que alguém já está testando a falha antiga. Para pais e adolescentes na Flórida, nada muda por enquanto: a moção é um pedido, não uma decisão, então o acesso de menores ao ChatGPT no estado permanece como está até um juiz decidir. Quem depende de produtos de IA para uma criança deve esperar mais disputas como essa, em mais estados, antes que as regras se estabilizem.
A grande questão
A segurança de software sempre partiu da premissa de que corrigir uma falha conhecida compra tempo antes que alguém a explore. Se um modelo de acesso aberto consegue transformar 2 falhas já divulgadas em um ataque funcional por US$ 20,40, quanto dessa premissa ainda se sustenta — e de quem é a responsabilidade de fechar essa brecha, agora que o custo de um ataque caiu tanto para praticamente qualquer pessoa com acesso à internet?
O que observar
Ainda não há data marcada para o julgamento da moção de liminar na Flórida; o pedido continua à espera de uma decisão. O relatório da Anthropic não diz se a mesma cadeia de exploit será testada contra modelos maiores ou outros fornecedores. Quem acompanha a velocidade com que falhas conhecidas viram ataques reais deve ficar de olho na próxima atualização do Frontier Red Team da Anthropic e na decisão do juiz no caso da Flórida — o que vier primeiro.



