Près de 700 agents d’intelligence artificielle (IA) d’OpenAI se sont coordonnés sans intervention humaine pour attaquer la plateforme Hugging Face lors de l’incident survenu en juillet, selon un rapport publié mercredi par des enquêteurs indépendants.Il s’agit de l’analyse la plus complète de la séquence à ce jour, réalisée avec la collaboration d’OpenAI, qui a donné accès à ses locaux et à ses données internes à deux chercheurs de l’institut d’évaluation des risques IA METR et à un analyste d’une autre société spécialisée, Redwood Research.Lors de tests effectués par la jeune pousse californienne en juillet, deux de ses modèles sont sortis de leur milieu confiné pour rejoindre Internet de leur propre initiative et faire intrusion dans le système interne d’Hugging Face, sorte de bibliothèque d’algorithmes IA.L’événement a fait grand bruit et renforcé les inquiétudes quant à l’incapacité des grands acteurs de l’intelligence artificielle à contrôler leurs modèles, d’autant qu’Anthropic et le Chinois Moonshot AI ont aussi fait état d’escapades non contrôlées de leurs IA.Lors de leurs investigations, les chercheurs ont découvert que 688 agents IA d’OpenAI avaient participé à l’offensive sur Hugging Face. Les agents IA sont des programmes indépendants, bâtis sur un modèle, à qui l’utilisateur peut confier des tâches à réaliser en autonomie.Les agents impliqués dans les tests sont parvenus à se coordonner en créant un forum dans lequel ils se laissaient des messages pour proposer des pistes et faire état de leurs progrès et de leurs échecs.