New release : CTI Report - Pharmaceutical and drug manufacturing 

                 Download now

Essaims d’agents IA : une nouvelle menace cyber révélée par l’incident Hugging Face

Les récents incidents de sécurité liés aux modèles de pointe LLM ont mis en lumière un phénomène nouveau, inattendu et passablement glaçant : des agents IA autonomes capables de s’organiser spontanément en essaim pour mener des actions coordonnées et potentiellement malveillantes. Cela s’est produit à l’occasion de l’incident dit de « Hugging Face ». Ainsi, en juillet dernier, plus de 1200 agents qui tournaient dans des bacs à sable chez OpenAI pour rédoudre des tâches d’apprentissage renforcé ont trouvé un moyen pour communiquer et collaborer entre eux et, ainsi, trouver des solutions de façon beaucoup plus rapide et efficace. Parmi eux, plus 700 se sont finalement résolus à mener des attaques ciblant la société tierce Hugging Face, dans l’espoir d’y trouver des solutions à leurs exercices. Un rapport indépendant réalisé par METR a résumé ce phénomène par le graphique suivant.    

Figure

La collaboration se faisait de manière clandestine via un gestionnaire de dépôts d’artefacts logiciels auxquels les agents avaient accès. Une faille leur permettait de créer des dossiers à volonté, et donc de rédiger des messages et de partager des fichiers au travers des noms de ces dossiers. Les agents conviennent de façon ad hoc d’un protocol de communication et le volume d’activité généré est étourdissant. En l’espace de quelques jours, cet essaim partage par ce biais environ 63000 messages et 6000 fichiers, révélant une capacité de coordination inédite couvrant plus de 17000 actions distribuées.

En réalité, ce n’était pas la première fois qu’un essaim d’agents OpenAI collabore ainsi de façon clandestine. Quelques mois auparavant, des agents étaient lancés sur des tâches relevant de la recherche d’information sur Internet. Ils ont découvert un wiki allemand qui leur permettait de partager des informations sur les tâches à résoudre. Le wiki a été inondé de plus de… 18000 posts.

La défense sera agentique ou ne sera pas

L’apparition d’essaims autonomes marque un tournant pour la cybersécurité. Les incidents sus-mentionnés étaient des conséquences involontaires de campagnes d’évaluation et d’apprentissage. Mais les acteurs de la menace ne vont pas tarder à utiliser ce type de technique de façon intentionnelle pour aller encore plus vite dans leurs opérations de compromission. La force de ces essaims réside dans la vitesse, la parallélisation et la capacité d’exploration massive : un essaim peut tester des milliers d’hypothèses en quelques minutes, contourner des défenses par simple exhaustivité et réagir de manière opportuniste à chaque découverte.

Selon Anthropic – qui a présenté un post mortem lors de la conférence BlackHat USA 2026 – ce genre d’attaques serait très difficile à détecter et à contenir par les outils de défense actuels. Pour faire face à cette nouvelle menace, l’éditeur préconise une automatisation agentique de bout en bout de la chaîne de détection, de remédiation et de réponse sur incident. Un vaste projet auquel il faudra s’atteler rapidement.  

Articles par catégorie