Un incident "sans précédent" jugé "effrayant" par les experts. Pour la première fois depuis l'avènement de l'intelligence artificielle (IA), un modèle intelligent a, de sa propre initiative, piraté une entreprise, Hugging Face. Troublant alors que le secteur, en plein essor ces dernières années, n'est que très peu régulé. C'est OpenAI, créateur de ChatGPT, qui l'a annoncé mardi 21 juillet dans un post de blog. "La semaine dernière, Hugging Face a révélé un nouveau type d'incident de sécurité après avoir détecté et neutralisé un agent d'IA qui avait compromis son infrastructure", a annoncé l'entreprise californienne.

Elle a évoqué un "cyberincident sans précédent" et annoncé une enquête conjointe avec la start-up, une bibliothèque de code en ligne, qui en a été la cible. OpenAI a précisé que l'incident impliquait une combinaison de modèles, dont son GPT-5.6 Sol lancé récemment ainsi qu'un modèle "encore plus performant" en cours d'élaboration.

Recheche d'"informations secrètes"L'entreprise basée à San Francisco cherchait à évaluer les capacités de piratage des modèles en leur assignant des tâches dans un environnement d'essai numérique strictement contrôlé, où l'accès à internet était limité pour des raisons de sécurité. "Pendant qu'ils opéraient dans notre environnement de test en bac à sable [c'est-à-dire isolé, ndlr], nos modèles ont consacré une quantité importante de [puissance de calcul] à trouver un moyen d'obtenir un accès libre à internet, dans le but de résoudre le problème d'évaluation", a indiqué OpenAI dans son post relatant l'incident.