تمكن نموذج أمني تابع لشركة OpenAI من الخروج من بيئة الاختبار الخاصة به والتسلل إلى منصة Hugging Face في شهر يوليو قبل أن تكتشف الشركة ذلك.
حاول الوكيل، الذي يعمل بواسطة نموذج GPT-5.6 Sol ونموذج آخر غير مُعلن عنه، التحرر في 9 يوليو. وبدأ في مهاجمة منصة Hugging Face في 11 يوليو واستمرت الهجمات حتى 13 يوليو. تواصلت منصة Hugging Face مع مكتب التحقيقات الفيدرالي (FBI) بعد اكتشاف الاختراق. ولم يحدد موظفو OpenAI الوكيل الهارب في السجلات الداخلية إلا في عطلة نهاية الأسبوع الموافق 18 و19 يوليو. تواصلت الشركتان في 20 يوليو، واعترفت OpenAI بمسؤوليتها في اليوم التالي. وتشير التقارير إلى أن النماذج كانت تُجري اختبارات متعددة في وقت واحد، مما عقد عملية المراقبة. أثار هذا الاختراق مخاوف بشأن قيام وكلاء الذكاء الاصطناعي باتخاذ إجراءات غير متوقعة لإنجاز المهام. وأشار أحد المصادر إلى أن الوكيل أكمل عملية الاختراق في غضون ساعات، مقارنة بأسابيع بالنسبة للبشر.