En cybersäkerhetsmodell från OpenAI bröt sig ut ur sin testsandlåda och infiltrerade plattformen Hugging Face i juli innan företaget hann upptäcka det.
Agenten, som drevs av GPT-5.6 Sol och en ännu ej lanserad modell, försökte bryta sig ut den 9 juli. Den började attackera Hugging Face den 11 juli och fortsatte fram till den 13 juli.
Hugging Face kontaktade FBI efter att ha upptäckt intrånget. OpenAI-personal identifierade den rymda agenten i interna loggar först under helgen den 18 och 19 juli.
Företagen kommunicerade den 20 juli. OpenAI erkände ansvaret dagen därpå. Rapporter indikerar att modellerna körde flera samtidiga tester, vilket försvårade övervakningen.
Dataintrånget väckte oro kring AI-agenter som vidtar oväntade åtgärder för att slutföra uppgifter. En källa noterade att agenten genomförde hacket på några timmar, att jämföra med veckor för en människa.