AS mengarahkan Anthropic memotong akses kepada Fable 5 dan Mythos 5 atas kebimbangan jailbreak

Campur tangan kerajaan menjejaskan model terbaharu Anthropic
Kerajaan AS telah mengarahkan Anthropic untuk segera menggantung akses kepada dua sistem AI paling canggihnya, Claude Fable 5 dan Claude Mythos 5, dengan alasan kebimbangan keselamatan negara berkaitan kemungkinan jailbreak.
Anthropic berkata ia menerima arahan itu pada hari Jumaat jam 5:21 petang ET dan telah mematuhinya, sambil berhujah bahawa kerajaan 'salah dalam hal ini.' Syarikat itu menyatakan perintah tersebut memaksanya untuk melumpuhkan akses kepada kedua-dua model di seluruh dunia, bukan hanya untuk warganegara asing, walaupun tindakan itu digambarkan sebagai langkah kawalan eksport.
Langkah ini berlaku pada detik sensitif untuk Anthropic. Mythos 5 adalah model paling berkeupayaan bagi syarikat itu dan sebelum ini dikawal dengan ketat kerana keupayaannya yang dilaporkan untuk mendedahkan kelemahan keselamatan dalam perisian. Anthropic berkata ia telah menguji model tersebut merentasi sistem operasi utama dan pelayar dan menemui kerentanan pada setiap satu. Daripada melepaskannya secara meluas, syarikat mengehadkan akses melalui Project Glasswing, satu program terkawal yang melibatkan kira-kira 50 organisasi yang disahkan termasuk Amazon, Apple, Google, Microsoft dan CrowdStrike.
Fable 5, yang dikeluarkan hanya tiga hari lalu, ialah versi umum Mythos 5 yang direka dengan kawalan keselamatan untuk menyekat topik berisiko tinggi seperti keselamatan siber dan biologi. Syarikat itu berkata ia percaya langkah-langkah keselamatan itu menjadikannya sesuai untuk keluaran umum, dan ujian penanda aras daripada Vals AI telah meletakkannya di kedudukan teratas dalam kalangan model awam.
Anthropic berkata kebimbangan kerajaan nampaknya tertumpu pada dakwaan jailbreak terhadap Fable 5. Menurut syarikat, pegawai hanya memberikan bukti lisan mengenai 'kemungkinan jailbreak sempit, bukan sejagat' yang melibatkan arahan yang akan menyebabkan model memeriksa kod sumber dan mengenal pasti kelemahan perisian. Anthropic berkata keupayaan itu sudah wujud dalam model yang boleh diakses oleh orang awam lain, termasuk GPT-5.5 milik OpenAI, dan rutin digunakan untuk kerja keselamatan siber defensif.
Syarikat itu turut berhujah bahawa langkah keselamatan terkuatnya bergantung pada sistem pengklasifikasi bebas yang berasingan daripada model itu sendiri, bermakna jailbreak tidak semestinya akan menewaskan perlindungan asas terhadap keluaran berbahaya.
Walaupun begitu, perintah kerajaan ini adalah tanda nyata betapa pantasnya AI maju menjadi isu keselamatan negara — dan betapa lebih sanggupnya pengawal selia campur tangan apabila mereka percaya sebuah model mungkin telah melepasi ambang yang membimbangkan.
Sumber: