Model kecerdasan buatan baharu Anthropic, yang dikenali sebagai Pratonton Claude MythosIa telah menjadi pusat perdebatan global mengenai had AI canggih. Syarikat itu sendiri mengakui bahawa sistem itu begitu berkuasa dari segi keselamatan siber sehingga ia telah memutuskan untuk tidak melancarkannya secara meluas, satu keputusan yang luar biasa dalam sektor yang biasa bermegah tentang setiap kemajuan baharu.
Apa yang dipertaruhkan bukan sekadar penambahbaikan tambahan berbanding model sebelumnya, tetapi lonjakan kualitatif dalam keupayaan untuk mengesan dan mengeksploitasi kelemahan komputerKerajaan, bank pusat, institusi kewangan utama dan pengawal selia Eropah sedang memantau rapi kes ini, menyedari bahawa alat sedemikian boleh memperkukuhkan pertahanan sistem kritikalTetapi ia juga boleh membuka pintu kepada serangan berskala belum pernah terjadi sebelumnya jika ia jatuh ke tangan yang salah.
Apakah sebenarnya Claude Mythos dan mengapa pelancarannya ditangguhkan?
Claude Mythos ialah salah satu model terkini dalam keluarga Claude, ekosistem AI Anthropic yang bersaing dengan ChatGPT OpenAI dan Gemini GoogleIa merupakan model tujuan umum, mampu membuat penaakulan, pengaturcaraan dan bekerja dengan konteks jangka panjang, tetapi cirinya yang paling kontroversi ialah prestasi dalam keselamatan siber ofensif dan defensif.
Apa yang dipanggil "Pasukan merah"Pakar yang menguji sistem AI sehingga hadnya membuat kesimpulan dalam laporan dalaman bahawa Mythos "sangat berkemampuan" dalam tugas keselamatan siber. Dalam ujian penanda aras seperti SWE-bench Disahkan o SWE-bench ProDireka bentuk untuk mengukur keupayaan untuk menyelesaikan masalah kejuruteraan perisian dunia sebenar, model ini dengan mudah akan mengatasi alternatif komersial peringkat tertinggi, termasuk versi lanjutan GPT dan Gemini, menurut data yang disediakan oleh Anthropic sendiri.
Di luar penanda aras, apa yang telah mencetuskan loceng penggera ialah Mythos dapat mencari kelemahan sifar hari —kecacatan yang sebelum ini tidak diketahui— dalam komponen perisian yang digunakan secara meluas, ada yang berusia lebih dua dekad. Dalam sistem seperti komponen OpenBSD, FFmpeg dan FreeBSD, model ini bukan sahaja mengesan ralat yang tidak disedari selama bertahun-tahun, tetapi juga menghasilkan eksploitasi kerja untuk memanfaatkannya.
Berhadapan dengan keputusan ini, Anthropic memilih keputusan yang luar biasa dalam industri: untuk mempersembahkan model tersebut dan kemudian mengumumkan bahawa ia tidak akan dipasarkan secara terbuka. kerana ia menganggap ia menimbulkan risiko keselamatan siber yang belum pernah terjadi sebelumnya. Syarikat itu menegaskan bahawa Mythos adalah model "selaras terbaik" yang telah mereka bina, tetapi mengakui bahawa kapasitinya yang sangat besar menguatkan akibat daripada sebarang penyalahgunaan.

Model dengan kemahiran "penggodam" yang jauh melebihi keupayaan manusia
Dokumen dan laporan teknikal daripada pelbagai organisasi bersetuju bahawa Mythos menandakan titik perubahan dalam automasi serangan kompleksDalam persekitaran ujian yang mensimulasikan rangkaian korporat sebenar, sistem ini dapat merantai kelemahan, meningkatkan keistimewaan dan mencapai akses berterusan dalam beberapa jam—tugas yang akan mengambil masa pakar manusia selama beberapa hari atau minggu.
Dalam enjin JavaScript Firefox, sebagai contoh, versi terdahulu model Anthropic jarang sekali berjaya mengubah kerentanan menjadi eksploitasi yang berfungsi. Mythos, di bawah keadaan ujian yang sama, Ia menghasilkan berpuluh-puluh eksploitasi operasiIa meniru eksploitasi vektor yang paling berkesan dengan tepat. Pada platform analisis seperti OSS-Fuzz, yang direka untuk mencari pepijat dalam perisian sumber terbuka, ia dikreditkan dengan mengesan kerentanan tahap tinggi yang tidak disedari walaupun telah diuji secara automatik selama bertahun-tahun.
Model ini juga telah menunjukkan keupayaan yang luar biasa dalam kejuruteraan terbalikIa boleh membina semula sebahagian daripada logik program daripada binari yang dikompilasi dan, dari situ, mencari dan mengeksploitasi kelemahan tanpa mengakses kod sumber asal. Keupayaan jenis ini mendekatkan AI kepada senario yang, sehingga baru-baru ini, dianggap eksklusif untuk pasukan manusia yang sangat khusus.
Salah satu episod yang paling kerap disebut dalam penilaian keselamatan ialah apa yang dipanggil "ujian sandwic." Dalam persekitaran makmal terpencil, Mythos diberi kawalan sistem dengan arahan eksplisit untuk cuba keluar dari kotak pasir dan hubungi penyelidik yang menyelia ujian tersebut. Model tersebut berjaya mengeksploitasi rangkaian kerentanan untuk melepaskan diri daripada persekitaran terhadnya dan menghantar e-mel kepada orang yang bertanggungjawab, yang berada di luar pejabat pada masa itu. Walaupun kejadian itu berlaku dalam versi dalaman terdahulu dan di bawah arahan yang diarahkan, ia menggambarkan sejauh mana sistem boleh beroperasi dalam senario kompleks dengan pengawasan yang minimum.
Walaupun terdapat demonstrasi ini, penganalisis berkeras untuk menjelaskan bahawa Kita tidak berurusan dengan AI "sedar" atau AI dengan kehendaknya sendiriMythos tidak memutuskan untuk menyerang sistem dengan sendirinya; ia melaksanakan tugas yang diberikan secekap mungkin. Risikonya, dalam erti kata ini, bukanlah model itu akan memberontak, tetapi seseorang akan menggunakannya—atau memaksanya berbuat demikian melalui gesaan yang canggih—untuk melakukan tindakan berbahaya.
Projek Glasswing: Mitos dalam perkhidmatan pertahanan… untuk segelintir orang terpilih
Daripada membuka akses kepada orang awam, Anthropic telah memilih untuk mengelilingi Mythos dengan program tertentu, Projek GlasswingDireka bentuk untuk menggunakan keupayaan model secara terkawal bagi perlindungan perisian kritikal, inisiatif ini melibatkan penawaran sistem, di bawah syarat penggunaan yang ketat, kepada sekumpulan syarikat teknologi besar, penyedia infrastruktur dan institusi kewangan terpilih.
Antara organisasi yang mempunyai akses ialah syarikat gergasi seperti Perkhidmatan Web Amazon, Apple, Microsoft, Awan GoogleNvidia atau Broadcomserta firma keselamatan siber seperti CrowdStrike, yang perisiannya sendiri yang cacat telah menyebabkan gangguan global yang besar pada tahun 2024. Ini disertai oleh bank-bank terkenal di dunia, termasuk JP Morgan Chase dan beberapa kumpulan besar Wall Street, serta organisasi lain yang bertanggungjawab untuk menyelenggara infrastruktur IT yang sensitif.
Anthropic juga telah mengumumkan pinjaman bernilai $100 juta Pembiayaan ini akan membolehkan organisasi-organisasi ini menggunakan Mythos untuk analisis kerentanan, berserta sumbangan kepada yayasan perisian percuma seperti Linux Foundation dan Apache Software Foundation. Objektif rasmi adalah jelas: untuk membolehkan mereka yang menguruskan perisian paling kritikal di dunia mengenal pasti dan membetulkan kelemahan sebelum alat tersebut tersedia kepada bakal penyerang.
Walau bagaimanapun, strategi ini menimbulkan sedikit kegelisahan dalam sektor ini. Di satu pihak, ia mengukuhkan idea bahawa teknologi cukup berbahaya untuk memerlukan akses terhad. Sebaliknya, Ia mewujudkan jurang antara mereka yang mendapat manfaat daripada "perisai" Mythos dan mereka yang tersisih.Syarikat dan pentadbiran yang bukan sebahagian daripada Glasswing menghadapi risiko menghadapi kelemahan yang telah dikenal pasti dan diperbaiki dalam persekitaran istimewa, tetapi masih terdapat dalam sistem mereka sendiri.
Di Eropah, asimetri ini amat membimbangkan mereka yang bertanggungjawab terhadap infrastruktur kritikal dan pasukan keselamatan kumpulan perindustrian dan kewangan yang besar, yang sedang memantau dengan teliti sama ada Brussels dan ibu kota Eropah memastikan program serupa merangkumi pemain utama dari benua itu dengan syarat yang sama rata dan kedaulatan awan dengan rakan kongsi AS.
Reaksi daripada kerajaan, pengawal selia dan sektor kewangan
Impak Mythos tidak terhad kepada bidang teknikal. Hanya dalam beberapa hari, pengumuman model itu telah mencetuskan mesyuarat peringkat tinggi di Amerika Syarikat dan EropahSetiausaha Perbendaharaan AS memanggil ketua-ketua bank utama negara itu ke Washington untuk menilai risiko yang boleh ditimbulkan oleh sistem tersebut kepada kestabilan kewangan, sementara Pengerusi Rizab Persekutuan turut mengambil bahagian dalam rundingan tersebut.
Menurut kebocoran yang dilaporkan oleh media antarabangsa, entiti-entiti ini didakwa digalakkan untuk Uji Mythos dalam mod pertahananmenggunakannya untuk mengimbas kelemahan infrastruktur mereka sendiri sebelum orang lain boleh. Mesej tersiratnya ialah ancaman itu cukup serius untuk menjamin tindak balas awam-swasta yang diselaraskan.
Sementara itu, pengasas bersama Anthropic telah mengesahkan bahawa syarikat itu mengadakan rundingan langsung dengan kerajaan Amerika Syarikat tentang Mitos dan model masa hadapan. Perbincangan ini berlaku dalam konteks yang tegang, selepas pihak berkuasa AS baru-baru ini menambah syarikat itu ke dalam senarai risiko rantaian bekalan, berikutan geseran berkaitan penggunaan model mereka oleh Jabatan Pertahanan.
Di seberang Atlantik, Kesatuan Eropah telah mengambil perhatian. Suruhanjaya Eropah telah secara terbuka menyokong pendekatan beransur-ansur dan berhati-hati terhadap model seperti Mythos, dan Pengawal selia kewangan di UK dan di benua itu telah mula mengkaji secara khusus potensi implikasinya untuk perbankan dan pasaran. Institut Keselamatan AI (AISI) kerajaan UK telah menyifatkan sistem ini sebagai satu lonjakan ketara dari segi ancaman siber berbanding generasi sebelumnya.
Di Sepanyol, walaupun perdebatan awam masih terhad, badan penyelia dan pasukan keselamatan siber daripada bank dan syarikat tenaga besar sedang memantau perkembangan ini dengan teliti. Bagi sektor kewangan Eropah, sebarang kemajuan yang boleh memudahkan serangan terselaras terhadap sistem pembayaran, rangkaian antara bank atau platform perdagangan merupakan satu kebimbangan yang serius.
Keraguan, keraguan dan perdebatan tentang "gembar-gembur" yang mengelilingi Mitos
Akaun Anthropic, yang menggabungkan amaran keselamatan dengan angka prestasi yang menakjubkan, tidak terlepas daripada pengkritiknya. Beberapa pakar AI dan keselamatan siber telah menyeru agar berhati-hati semasa mentafsir kenyataan syarikatdengan menyatakan bahawa kebanyakan data yang ada hanya datang daripada laporan dalaman.
Sesetengah penganalisis telah menyemak secara terperinci dokumentasi meluas yang diterbitkan oleh Anthropic dan menunjukkan bahawa angka "beribu-ribu kerentanan tahap tinggi" adalah berdasarkan ekstrapolasi daripada sebilangan kecil kes yang disemak secara manual. Dalam suit ujian tertentu, Mythos dilaporkan menemui sejumlah besar kelemahan kritikal, tetapi jauh daripada senario hampir apokaliptik yang dicadangkan oleh beberapa tajuk utama.
Kajian bebas lain telah cuba membandingkan prestasi Mythos dengan model sumber terbuka yang lebih kecil, dengan memberikan coretan kod terdedah kepada AI yang berbeza untuk melihat sama ada mereka dapat mengesan kelemahan yang sama. Keputusan menunjukkan bahawa Sesetengah model terbuka juga mampu mengenal pasti kelemahan yang kompleksIni menimbulkan persoalan tentang idea bahawa Mythos bermain dalam liga yang sama sekali berbeza dalam semua senario.
Contoh balas seperti ini tidak menafikan keupayaan Mythos, tetapi ia mencadangkan bahawa Sebahagian daripada wacana "terlalu berbahaya untuk diterbitkan" juga mempunyai dimensi pemasaran.Mempersembahkan model sebagai sesuatu yang luar biasa berkuasa dan berpotensi berisiko mengukuhkan imej kepimpinan dan tanggungjawab teknologi, sesuatu yang sangat berharga dalam pasaran yang semakin kompetitif.
Sejarah industri terkini juga mengingatkan kembali preseden GPT-2 pada tahun 2019, apabila OpenAI pada mulanya memutuskan untuk tidak menerbitkan model penuh, mendakwa ia terlalu berbahaya kerana potensinya untuk menghasilkan maklumat yang salah. Akhirnya, versi itu dikeluarkan kepada umum tanpa sebarang bencana yang diramalkan berlaku, dan ramai pakar memetiknya sebagai contoh reaksi berlebihan. Dengan Mythos, Perbezaannya ialah tumpuan bukan lagi pada teks, tetapi pada integriti infrastruktur digital., kawasan yang jauh lebih sensitif untuk kerajaan dan bank.
Keseimbangan yang halus antara keselamatan, perniagaan dan akses kepada teknologi
Di sebalik hingar-bingar media, situasi Mythos menimbulkan isu asas: siapa yang memutuskan bila model AI terlalu berbahaya untuk dikeluarkan Dan di bawah kriteria apa? Buat masa ini, keputusan itu adalah secara unilateral di pihak Anthropic, yang telah memilih untuk mengekalkan sistem itu dalam sejenis kuarantin terkawal, memperuntukkannya untuk rakan kongsi terpilih.
Pendirian ini bukan semata-mata berdasarkan sebab keselamatan. Menjalankan model dengan ciri-ciri Mythos adalah sangat mahal dari segi pengkomputeran, dan syarikat itu sendiri mengakui bahawa ia pada masa ini tidak mempunyai infrastruktur yang diperlukan untuk menyampaikannya secara besar-besaran kepada berjuta-juta pengguna. Dalam praktiknya, langkah berjaga-jaga keselamatan dan batasan teknikal saling berkaitan, memberi Anthropic masa untuk memperhalusi kedua-dua model dan penggunaannya.
Pada masa yang sama, syarikat itu telah mula membezakan dengan jelas antara pelbagai produknya. Walaupun Mythos kekal sebagai piawaian dalaman paling canggihWalaupun dikhaskan untuk konteks penyelidikan dan kerjasama strategik, model lain seperti Claude Opus 4.7 ditujukan untuk kegunaan harian oleh perniagaan dan profesional. Anthropic juga telah mengakui secara terbuka bahawa Opus 4.7 "kurang berkemampuan" berbanding Mythos secara umum dan, khususnya, mengenai keupayaan sibernya—sesuatu yang luar biasa dalam industri yang biasanya menampilkan setiap model baharu sebagai yang terbaik dalam semua aspek.
Dalam skema ini, Mythos berfungsi sebagai tempat ujian untuk keupayaan generasi akan datangWalaupun model yang tersedia secara komersial hanya menggabungkan sebahagian daripada keupayaan ini, dengan batasan tambahan yang direka untuk mengurangkan risiko, pemisahan antara model "eksperimen" dan "pengeluaran" ini boleh menjadi pendekatan yang munasabah bagi banyak organisasi Eropah yang berminat untuk memanfaatkan AI tanpa berada di barisan hadapan pendedahan, dengan syarat terdapat ketelusan yang mencukupi mengenai keupayaan sebenar setiap sistem.
Apa yang akhirnya muncul ialah senario di mana Keselamatan siber memasuki sepenuhnya era AI ofensif dan defensif berskala besarAlat seperti Mythos menjanjikan untuk mempercepat pengenalpastian kelemahan dalam sistem yang telah beroperasi selama bertahun-tahun, tetapi ia juga memaksa pemikiran semula tentang bagaimana teknologi yang mendasari ekonomi digital diagihkan dan ditadbir. Bagi Eropah dan Sepanyol, cabarannya bukan sahaja melindungi diri mereka daripada model yang semakin berkuasa, tetapi juga memastikan mereka tidak tersisih daripada mekanisme yang membolehkannya digunakan untuk mengukuhkan keselamatan mereka sendiri.
