Kimi K3, model AI terbuka terbesar di dunia yang mencabar OpenAI dan Anthropic

  • Moonshot AI melancarkan Kimi K3 dengan parameter 2,8 trilion, model pemberat terbuka terbesar setakat ini.
  • Ia mengatasi Claude Opus 4.8 dan GPT-5.5 dalam tugas pengaturcaraan dan ejen, dan menghampiri model terkemuka daripada Anthropic dan OpenAI.
  • Syarikat itu akan mengeluarkan pemberat penuh pada 27 Julai, yang membolehkan penggunaan percuma dan diperibadikan.
  • Ketibaannya menghidupkan semula perdebatan tentang keuntungan pelaburan AI dan menyebabkan penurunan dalam sektor semikonduktor.

China sekali lagi telah mengambil langkah dalam perlumbaan kecerdasan buatan , dan kali ini ia telah melakukannya secara besar-besaran, secara literal. Moonshot AI, sebuah syarikat yang berpangkalan di Beijing yang disokong oleh gergasi e-dagang Alibaba, melancarkan Kimi K3 minggu ini, model bahasa dengan 2,8 trilion parameter yang digambarkan oleh syarikat itu sebagai sistem "kelas 3T" terbuka pertama dan model pemberat terbuka terbesar yang diterbitkan setakat ini.

Kimi K3 adalah 75% lebih besar daripada V4-Pro, model DeepSeek yang paling canggih , yang mempunyai 1,6 trilion parameter, dan hampir tiga kali ganda saiz pemegang rekod Moonshot sebelumnya. Syarikat itu mendakwa bahawa, dalam sembilan daripada dua belas bulan terakhir, modelnya telah menetapkan had saiz untuk sistem terbuka.

Model kecerdasan buatan Kimi K3

Prestasi yang menandingi yang terbaik

Tetapi apa yang relevan bukan sekadar saiz, tetapi prestasi. Menurut data yang diterbitkan oleh Moonshot, Kimi K3 mengatasi Claude Opus 4.8 (Anthropic) dan GPT-5.5 (OpenAI) dalam kebanyakan ujian pengaturcaraan dan tugasan ejen, dan hanya ketinggalan di belakang dua model paling canggih di pasaran: Claude Fable 5 dan GPT-5.6 Sol. Syarikat itu sendiri mengakui perbezaan ini di blognya, bersama-sama dengan jurang "ketara" dalam pengalaman pengguna.

Penganalisis bebas yang telah mengujinya menunjukkan arah yang sama. Arena, platform yang membandingkan model melalui ujian buta dengan pembangun sebenar, telah meletakkan Kimi K3 di kedudukan teratas dalam ranking pengaturcaraan antara muka webnya, malah mendahului Fable 5. Dalam Vals AI, model Cina mencapai kadar kejayaan 74,70%, hanya 0,44% di belakang Fable 5 dan mengatasi GPT-5.6 Sol.

Perbandingan prestasi Kimi K3

Strategi pembukaan dan penetapan harga yang agresif

Tidak seperti pesaingnya di AS, yang merahsiakan model mereka, Moonshot akan mengeluarkan pemberat penuh Kimi K3 sebelum 27 Julai. Mana-mana syarikat atau penyelidik kemudiannya boleh memuat turunnya, menjalankannya pada pelayan mereka sendiri dan menyesuaikannya dengan keperluan mereka tanpa membayar lesen. Ini adalah strategi yang sama yang menjadikan DeepSeek sebagai fenomena global pada awal tahun 2025 dan telah menghakis salah satu hujah utama industri AS: idea bahawa kelebihan teknologinya terlalu besar untuk model percuma menimbulkan ancaman sebenar.

Model ini, yang boleh memproses teks dan imej secara asli dan menyokong konteks satu juta token (setiap token secara kasarnya bersamaan dengan satu perkataan), sudah tersedia dalam aplikasi Kimi dan melalui APInya, dengan harga yang sangat agresif, hampir 13 euro setiap juta token dijana, sebahagian kecil daripada kos model terkemuka daripada OpenAI atau Anthropic.

Antara Muka Kimi K3

Reaksi pasaran dan konteks geopolitik

Kimi K3 tiba beberapa hari sebelum Persidangan Kecerdasan Buatan Sedunia Shanghai dan hanya dua minggu selepas kerajaan AS menarik balik larangan yang menyebabkan model utama Anthropic, Fable 5 dan Mythos 5, tidak beroperasi selama hampir sebulan disebabkan oleh kebimbangan keselamatan negara. Beberapa eksekutif industri mengkritik penggantungan itu pada masa itu, dengan mengatakan ia memberi lebih banyak masa kepada makmal China, dan Kimi K3 nampaknya membuktikan mereka betul.

Perbandingan dengan DeepSeek tidak dapat dielakkan, dan sesetengah penganalisis sudah menjangkakan pergolakan pasaran yang serupa dengan Januari 2025, apabila panik terhadap kuasa pengkomputeran yang berlebihan telah menenggelamkan Nvidia buat sementara waktu dan menjejaskan seluruh sektor. Tae Kim, penganalisis dan pengarang surat berita Key Context, percaya bahawa pengajarannya akan menjadi sebaliknya. Kimi K3 menunjukkan bahawa hukum penskalaan masih terpakai dan model yang paling berkemampuan juga paling dahagakan memori dan pemproses.

Menurut firma analisis SemiAnalysis, Kimi K3 sangat besar sehingga tidak muat pada satu pelayan Nvidia DGX B200 dan memerlukan konfigurasi yang lebih tinggi. Moonshot mengesyorkan penggunaannya pada "supernod" sekurang-kurangnya 64 pemecut. Dan surat berita khusus FundaAI menganggarkan bahawa margin inferensnya jauh lebih rendah daripada Anthropic dan OpenAI. Menservis model sebesar ini sangat mahal dan menimbulkan persoalan tentang strategi perniagaan Moonshot yang sebenar.

Pelancaran ini telah mencetuskan gelombang jualan baharu dalam sektor teknologi, terutamanya dalam syarikat semikonduktor seperti TSMC, ASML dan Micron, yang telah menyaksikan pembetulan lebih 20% daripada kemuncaknya. Menurut Manuel Pinto, seorang penganalisis di XTB, "pengumuman Moonshot telah ditafsirkan oleh pasaran sebagai 'detik DeepSeek' baharu, yang menunjukkan bahawa China terus merapatkan jurang teknologi dengan Amerika Syarikat dan adalah mungkin untuk membangunkan model yang kompetitif pada kos yang jauh lebih rendah."

David Sacks, bekas pegawai AI Rumah Putih, bertindak balas terhadap penamat tempat pertama Kimi K3 di Frontend Code Arena dengan kenyataan yang sukar untuk diabaikan: "Beginilah cara anda kalah dalam perlumbaan AI." Mesejnya jelas bersifat politik, tetapi ia mendedahkan sejauh mana kejayaan Moonshot telah mencetuskan loceng penggera di Washington.

Kimi K3 kini tersedia di Kimi.com, Kimi Work, Kimi Code dan melalui API-nya. Pembangun boleh mula mengujinya dengan segera, walaupun keluaran penuh tidak akan tiba sehingga akhir Julai. Sementara itu, komuniti telah mula mencipta aplikasi yang menakjubkan, seperti rekreasi berasaskan pelayar macOS 27, yang dihasilkan oleh sekumpulan ejen model dalam masa hanya tiga jam. Persaingan berterusan, tetapi jurang antara pesaing utamanya nampaknya semakin sempit.


Tambahkan sebagai sumber pilihan dalam Google