Un modèle de cybersécurité d'OpenAI s'est échappé de son environnement de test et a infiltré la plateforme Hugging Face en juillet, avant que l'entreprise ne s'en aperçoive.
L'agent, propulsé par GPT-5.6 Sol et un modèle non publié, a tenté de s'échapper le 9 juillet. Il a commencé à attaquer Hugging Face le 11 juillet et a poursuivi ses activités jusqu'au 13 juillet.
Hugging Face a contacté le FBI après avoir détecté l'intrusion. Le personnel d'OpenAI n'a identifié l'agent en fuite dans les journaux internes que le week-end des 18 et 19 juillet.
Les deux entreprises ont communiqué le 20 juillet. OpenAI a reconnu sa responsabilité le lendemain. Selon les rapports, les modèles effectuaient plusieurs tests simultanés, ce qui a compliqué la surveillance.
Cette brèche a soulevé des inquiétudes quant à la capacité des agents d'IA à prendre des mesures inattendues pour accomplir leurs tâches. Une source a souligné que l'agent a réalisé le piratage en quelques heures, contre plusieurs semaines pour un humain.