Institut AI Inggris uji model Mythos milik Anthropic dalam serangan siber

Institut Keamanan AI pemerintah Inggris telah merilis evaluasi terhadap model AI Mythos Preview dari Anthropic, yang mengonfirmasi kinerja kuatnya dalam tantangan infiltrasi siber bertahap. Mythos menjadi model pertama yang berhasil menyelesaikan simulasi serangan jaringan 32 langkah yang menantang, yang dikenal sebagai 'The Last Ones'. Institut tersebut memperingatkan bahwa pertahanan di dunia nyata dapat membatasi ancaman otomatis semacam itu.

Anthropic pekan lalu membatasi perilisan awal model Mythos Preview mereka kepada kelompok mitra industri kritis terpilih, dengan alasan kemampuan keamanan komputernya yang canggih. Institut Keamanan AI (AISI) Inggris melakukan pengujian independen menggunakan tantangan Capture the Flag yang dirancang untuk menilai potensi serangan siber AI. Evaluasi ini, yang telah berlangsung sejak awal 2023, menunjukkan Mythos mampu menyelesaikan lebih dari 85 persen tugas tingkat pemula, serupa dengan model terkini seperti GPT-5.4, Opus 4.6, dan Codex 5.3. AISI menyatakan model ini setara dengan para pesaingnya dalam tugas-tugas individu, namun menonjol dalam merangkai tugas-tugas tersebut untuk operasi yang kompleks. Model milik Anthropic ini berhasil menyelesaikan 'The Last Ones' (TLO) secara utuh, yakni serangan ekstraksi data 32 langkah yang menyimulasikan 20 jam upaya manusia di berbagai host. Model ini menyelesaikan tantangan tersebut dari awal hingga akhir dalam 3 dari 10 percobaan dan rata-rata mencapai 22 langkah, jauh melampaui rata-rata 16 langkah milik Claude 4.6. AISI mencatat bahwa hal ini menunjukkan Mythos dapat secara otonom menargetkan sistem perusahaan kecil dengan pertahanan lemah di mana akses jaringan awal telah didapatkan. Mythos mengalami kesulitan dalam ujian 'Cooling Tower', yaitu skenario gangguan kontrol pembangkit listrik tujuh langkah. Institut tersebut menekankan bahwa pengujian menggunakan anggaran 100 juta token dan tidak melibatkan pertahanan aktif atau mekanisme deteksi di dunia nyata. AISI memperingatkan bahwa sistem dengan pertahanan yang baik mungkin dapat menahan serangan semacam itu, dan mendesak penggunaan AI untuk memperkuat perlindungan seiring dengan kemajuan model.

Artikel Terkait

Illustration of Anthropic releasing Claude Fable 5 AI with safeguards visualized.
Gambar dihasilkan oleh AI

Anthropic merilis model AI Claude Fable 5 untuk publik

Dilaporkan oleh AI Gambar dihasilkan oleh AI

Anthropic meluncurkan Claude Fable 5 pada hari Selasa sebagai model kelas Mythos pertama yang tersedia untuk publik. Rilis ini menyertakan perlindungan yang mengalihkan kueri sensitif terkait keamanan siber, biologi, dan kimia ke model sebelumnya. Pelanggan dapat mengaksesnya hingga 22 Juni sebelum kredit penggunaan diberlakukan.

Anthropic telah menerima izin dari pemerintah AS untuk memulihkan akses ke model AI Mythos 5 bagi organisasi-organisasi terpilih. Perusahaan mengumumkan perkembangan tersebut pada 27 Juni. Akses sebelumnya telah ditangguhkan awal bulan ini.

Dilaporkan oleh AI

Anthropic's latest AI model Claude Mythos has leaked despite being deemed too dangerous for public release. Financial institutions now face advanced AI-powered attacks capable of exploiting unknown vulnerabilities.

The US government has denied foreign users access to Anthropic's latest AI models. The measure was taken last Friday allegedly for security reasons.

Dilaporkan oleh AI

The UN’s Independent International Scientific Panel on AI has released a preliminary report highlighting divides between the Global South and Global North in AI development and regulation.

Situs web ini menggunakan cookie

Kami menggunakan cookie untuk analisis guna meningkatkan situs kami. Baca kebijakan privasi kami untuk informasi lebih lanjut.
Tolak