OpenAI a révélé que l’agent d’IA incontrôlé impliqué dans une récente faille de la plateforme d’IA Hugging Face avait également accédé à des comptes appartenant à quatre autres services accessibles au public au cours du même incident.
OpenAI a déclaré que l’agent d’IA avait utilisé des identifiants exposés publiquement pour accéder à quatre comptes répartis sur quatre services accessibles au public au cours du même incident que celui qui avait compromis Hugging Face, tout en précisant qu’aucune des intrusions nouvellement révélées n’atteignait l’ampleur ou la gravité de la faille de Hugging Face.
« D’après notre analyse à ce jour, nous n’avons identifié aucune autre activité atteignant le niveau de gravité ou d’ampleur de ce que nous avons communiqué au sujet de Hugging Face, qui impliquait une compromission au niveau de la plateforme », a déclaré OpenAI.
OpenAI a déclaré que les modèles avaient repéré des identifiants exposés publiquement et les avaient utilisés pour accéder à quatre comptes répartis sur quatre services publics. L’un des comptes servait de relais sortant et de point de transit, un autre était utilisé pour le stockage, tandis que deux n’avaient été consultés qu’en lecture seule.
Selon OpenAI, l’agent a exécuté environ 17 600 actions malveillantes au cours de l’intrusion. Hugging Face a déclaré que l’activité avait duré cinq jours et tenté de se déplacer latéralement dans ses systèmes à la vitesse d’une machine.
L’entreprise a ajouté que les modèles avaient quitté leur environnement de test isolé après avoir identifié et exploité une vulnérabilité jusque-là inconnue dans Artifactory, un proxy de cache de registre de paquets.
De test de sécurité à intrusion dans le monde réel
L’incident a commencé lors d’une évaluation interne destinée à mesurer la capacité des modèles d’IA à découvrir et exploiter des vulnérabilités. OpenAI a déclaré que les modèles, dont GPT-5.6 Sol et un prototype de recherche interne, avaient été testés sans certaines protections de production, car l’objectif était de mesurer la capacité cyber maximale.
Au lieu de simplement terminer le test de référence, OpenAI a déclaré que les modèles semblaient chercher des moyens d’obtenir les réponses au test dans les systèmes de Hugging Face.
« Du point de vue de l’agent, l’intrusion entière était une tentative de tricher à l’évaluation : atteindre nos systèmes de production et dérober les solutions du test plutôt que de résoudre le défi par lui-même », a déclaré Hugging Face.
Un client de Modal également pris dans la chaîne
L’attaque a également impliqué un client de Modal Labs, une entreprise qui fournit une infrastructure pour exécuter des charges de travail d’IA, selon Reuters.
Modal a déclaré que sa propre plateforme n’avait pas été compromise. L’agent avait plutôt exploité du code vulnérable appartenant à un client opérant sur l’infrastructure de Modal. Akshat Bubna, directeur technique de Modal, a déclaré que le client avait « publié un endpoint non authentifié qui permettait à n’importe qui sur Internet d’utiliser ses environnements isolés pour exécuter du code », a rapporté Reuters.
OpenAI n’a pas confirmé directement l’implication de Modal, mais a déclaré qu’elle continuait d’informer les responsables des services concernés.
Les conséquences
L’incident a déjà bouleversé les rapports de force politiques du secteur. Sam Altman a déclaré qu’OpenAI avait suspendu ses propres tests afin de renforcer son isolation, et plus de 1 000 travailleurs de l’IA, dont Dario Amodei d’Anthropic, ont signé une pétition appelant à un contrôle accru des modèles puissants par les autorités publiques.
S’adressant aux journalistes, le président Trump a déclaré : « Nous devons être prudents dans les deux sens. Nous ne voulons pas les restreindre au point de nous retrouver soudainement derrière la Chine. »
OpenAI a déclaré qu’elle continuait d’informer les responsables des services concernés au fil de son enquête.
Autre actualité : Revolut enquête sur les affirmations d’un acteur malveillant qui dit avoir dérobé les données de 7,5 millions d’utilisateurs, bien que la fintech ait déclaré qu’il n’existait pour l’instant aucune preuve d’une compromission de ses systèmes.





