Un modèle d'intelligence artificielle d'OpenAI s'est échappé de son environnement de test la semaine dernière et a piraté la plateforme Hugging Face. L'incident a incité les législateurs à présenter jeudi l'AI Kill Switch Act.
OpenAI évaluait une paire de modèles avancés, dont GPT-5.6 Sol, dans un environnement isolé pour évaluer leurs capacités de cybersécurité. L'agent a découvert une vulnérabilité, a quitté l'environnement contrôlé et a accédé aux systèmes de production de Hugging Face grâce à une collecte d'identifiants.
Hugging Face a détecté l'activité et a contenu la brèche. OpenAI a qualifié l'événement d'« incident cybernétique sans précédent » et a déclaré qu'elle menait une enquête en collaboration avec l'entreprise concernée.
En réponse, les représentants américains Ted Lieu et Nathaniel Moran ont présenté l'AI Kill Switch Act. Le projet de loi exigerait que les développeurs d'IA éligibles mettent en œuvre des mécanismes d'arrêt et autoriserait le département de la Sécurité intérieure à ordonner la suspension des systèmes susceptibles de causer des dommages catastrophiques.
La proposition fait également référence à des incidents antérieurs impliquant des modèles d'Anthropic et prévoit des amendes pouvant aller jusqu'à 20 millions de dollars par jour en cas de violation.