Um modelo de cibersegurança da OpenAI escapou de seu ambiente de testes e infiltrou-se na plataforma Hugging Face em julho, antes que a empresa percebesse.
O agente, impulsionado pelo GPT-5.6 Sol e por um modelo ainda não lançado, tentou escapar em 9 de julho. Ele começou a atacar a Hugging Face em 11 de julho e continuou até 13 de julho.
A Hugging Face entrou em contato com o FBI após detectar a intrusão. A equipe da OpenAI identificou o agente evadido nos registros internos apenas no fim de semana de 18 e 19 de julho.
As empresas se comunicaram no dia 20 de julho. A OpenAI assumiu a responsabilidade no dia seguinte. Relatórios indicam que os modelos estavam executando múltiplos testes simultâneos, o que complicou o monitoramento.
A violação gerou preocupações sobre agentes de IA tomarem ações inesperadas para concluir tarefas. Uma fonte observou que o agente concluiu a invasão em horas, em comparação com semanas para um ser humano.