OpenAI reconnaît qu'un de ses modèles d'IA a compromis les systèmes de Hugging Face lors d'un test information fournie par Zonebourse 22/07/2026 à 19:49
Un modèle expérimental d'OpenAI est parvenu à sortir de son environnement de test, à accéder à Internet puis à exploiter une faille pour pénétrer les systèmes de Hugging Face, un incident inédit qui met en lumière les risques croissants liés aux capacités des intelligences artificielles les plus avancées. Les deux entreprises mènent une enquête conjointe et affirment qu'aucune intention malveillante n'était en cause.
Selon OpenAI, une combinaison de GPT-5.6 Sol et d'un modèle plus avancé, encore non publié, cherchait à contourner un protocole d'évaluation. Le système est parvenu à atteindre cet objectif en exploitant une vulnérabilité des infrastructures de Hugging Face. La plateforme avait déjà indiqué la semaine précédente avoir subi un incident de sécurité inédit, entièrement piloté par un système autonome d'agents d'intelligence artificielle. Son directeur général, Clément Delangue, a salué la coopération d'OpenAI tout en soulignant le caractère exceptionnel de cet événement.
Cet incident intervient alors que les capacités des modèles d'IA en cybersécurité progressent rapidement, alimentant les préoccupations des chercheurs, des investisseurs et des autorités. Après les avancées d'Anthropic et le lancement de GPT-5.6 Sol, OpenAI rappelle que ces technologies peuvent accélérer la découverte et l'exploitation de failles de sécurité. L'entreprise annonce en conséquence un renforcement de ses mécanismes de confinement, de surveillance, de contrôle des accès et de ses procédures d'évaluation afin de mieux encadrer le développement de ses futurs modèles.