L'équipe sécurité d'Anthropic affirme qu'un modèle d'IA plus économique et librement accessible a construit, en moins d'une journée, une attaque fonctionnelle exploitant 2 failles logicielles déjà connues, pour la somme de 20,40 $. Ce prix illustre à quel point une cyberattaque réelle est désormais accessible à quiconque dispose d'un accès au modèle.
Ce qui s'est passé
Selon le Frontier Red Team d'Anthropic, un chercheur a utilisé GLM-5.3-Flash, la version plus légère et open-weight du modèle développé par la société chinoise Zhipu AI, pour construire une chaîne d'exploits fiable à partir de 2 failles déjà publiques. L'opération a coûté 20,40 $ aux tarifs de l'API de Zhipu. Elle a mobilisé 20 minutes d'attention humaine et 8 heures de travail du modèle, selon le rapport de l'équipe. Par ailleurs, le procureur général de Floride a demandé à un juge d'État d'empêcher OpenAI de proposer ChatGPT aux mineurs sur le territoire de l'État, le temps que son procès contre l'entreprise suive son cours. Cette demande figure parmi 6 interdictions listées dans une requête de 49 pages visant une injonction temporaire, déposée par voie électronique le 28 septembre. Aucun tribunal ne s'est encore prononcé sur l'une de ces 6 demandes.
Comment on en est arrivé là
Construire une chaîne d'exploits exige habituellement des jours de travail manuel de la part de spécialistes aguerris. Le test mené par Anthropic montre que cet écart se réduit. Les 2 failles utilisées étaient déjà publiques, ce qui signifie que des correctifs existaient, et pourtant un modèle bon marché a quand même réussi à en tirer une attaque opérationnelle. La requête de la Floride, elle, ne constitue pas une nouvelle plainte. Il s'agit d'une démarche insérée dans un procès que le procureur général de l'État a déjà intenté contre OpenAI, demandant à un juge de suspendre l'accès des mineurs avant que l'affaire ne soit tranchée. Aucune des deux histoires ne débouche sur une décision définitive. Toutes deux montrent des institutions qui tentent de rattraper quelque chose qui bouge déjà.
Pourquoi cela vous concerne
Pour quiconque gère des logiciels, une faille connue n'est plus sûre simplement parce qu'un correctif existe quelque part. Des outils d'IA peu coûteux permettent désormais aux attaquants d'agir avant que la plupart des utilisateurs n'aient mis à jour quoi que ce soit. Pour les développeurs, la leçon est claire : corriger vite, et partir du principe que quelqu'un teste déjà l'ancienne faille. Pour les parents et les adolescents de Floride, rien ne change pour l'instant. La requête reste une demande, pas une décision, donc l'accès des mineurs à ChatGPT dans l'État demeure inchangé jusqu'à ce qu'un juge tranche. Quiconque confie des produits d'IA à un enfant devrait s'attendre à voir se multiplier ce type de bataille judiciaire, dans d'autres États, avant que les règles ne se stabilisent.
La question de fond
La sécurité informatique a longtemps reposé sur l'idée qu'un correctif publié achète du temps avant qu'une faille ne soit exploitée. Si un modèle librement accessible peut transformer 2 failles déjà divulguées en une attaque fonctionnelle pour 20,40 $, combien de cette hypothèse tient encore debout, et à qui revient la tâche de combler cet écart maintenant que le coût d'une attaque est tombé si bas, à la portée de presque quiconque dispose d'une connexion internet ?
À surveiller
Aucune date d'audience n'a été fixée pour la requête en injonction de la Floride. La décision reste en attente. Le rapport d'Anthropic ne précise pas si la même chaîne d'exploits sera testée sur des modèles plus puissants ou d'autres fournisseurs. Les lecteurs qui suivent la vitesse à laquelle des failles connues se transforment en attaques réelles devraient surveiller la prochaine mise à jour du Frontier Red Team d'Anthropic, ainsi que la décision du juge dans l'affaire de Floride, selon ce qui arrivera en premier.



