ai models

Pecutan tiga minggu berat terbuka China: Kimi K3, Qwen3.8-Max, dan kelokan yang mungkin menamatkannya

Dalam tiga minggu, makmal AI terbesar China melancarkan atau membayangkan model berat terbuka bertaraf frontier — Kimi K3, Qwen3.8-Max, dan DeepSeek V4 yang sudah tersedia umum. Satu bacaan jujur: apa yang benar-benar keluar, apa yang masih janji, dan mengapa Beijing kini mungkin mengekang gelombang yang dicetuskannya sendiri.

T
Telli.sh Team
#open-llm#kimi-k3#qwen#deepseek#open-weight#china-ai#ai-models#meeting-notes

Antara 16 dan 26 Julai, tiga daripada makmal AI terbesar China meletakkan model terbuka bertaraf frontier di atas meja. Moonshot AI mengumumkan Kimi K3 pada 16 Julai dan melancarkan beratnya pada 26 Julai. Alibaba memperkenalkan Qwen3.8-Max pada 19 Julai di WAIC Shanghai. Barisan V4 DeepSeek mencapai ketersediaan umum (GA) sekitar 20 Julai. Tiga makmal, lebih kurang tiga minggu.

Coraknya sukar dilepaskan pandang, dan ia bukan corak yang membina reputasi dunia model terbuka China selama ini. Makmal-makmal ini terkenal dengan model yang kecil, pantas dan murah, tetapi menumbuk melebihi kelasnya. Gelombang ini ialah pertaruhan sebaliknya: sistem bertriliun parameter yang dilancarkan, atau dijanjikan, sebagai berat terbuka.

Ini ialah bacaan jujur terhadap gelombang itu: apa yang benar-benar keluar, apa yang masih pratonton atau janji, dan kelokan yang datang bersamanya — kerajaan yang sama yang memungkinkan pelancaran ini kini menimbang sama ada perlu mengekangnya. Jika anda membaca rumusan Julai kami, inilah sekuelnya, dan salah satu benang yang tergantung kini terungkai.

Deretan rak di sebuah fasiliti superkomputer besar

Image: OLCF at ORNL, Wikimedia Commons, CC BY 2.0.

Kimi K3 ialah yang benar-benar keluar

Ketika kami menulis tentang Kimi K3 pada Julai, beratnya masih sekadar janji — Moonshot AI pernah berkata "menjelang 27 Julai". Ia tiba pada 26 Julai: 1.56 terabait dalam 96 serpihan di Hugging Face, di bawah moonshotai/Kimi-K3. Itulah beritanya. Pengumuman ialah siaran akhbar; berat yang boleh dimuat turun ialah fakta yang boleh anda bina di atasnya.

Seni binanya ialah model mixture-of-experts besar — 2.8 trilion parameter keseluruhan, kira-kira 104 bilion aktif setiap token, menghalakan lebih kurang 16 daripada 896 pakar melalui mekanisme yang Moonshot namakan Kimi Delta Attention, dengan tetingkap konteks satu juta token dan peningkatan kecekapan penskalaan yang dilaporkan sekitar 2.5x berbanding K2. Dalam kedudukan bebas Artificial Analysis, ia menduduki tempat ke-4 daripada 189 model — di belakang Claude Fable 5 dan dua konfigurasi GPT-5.6 "Sol", di hadapan Opus 4.8 dan GPT-5.5. Bagi model terbuka yang boleh anda muat turun, sekadar berada dalam kalangan itu pun sudah menjadi kisahnya.

Baca lesennya sebelum merancang perniagaan di sekelilingnya. Kimi K3 bukan MIT. Ia keluar di bawah lesen tersendiri "Kimi K3 License" yang tidak diluluskan OSI dan membawa klausa ambang hasil: menjalankan K3 sebagai enjin perniagaan Model-as-a-Service besar memerlukan perjanjian berasingan dengan Moonshot. Bagi kebanyakan pasukan, itu tidak mengubah apa-apa; tetapi bagi sesiapa yang membina produk terhos berskala besar, "berat terbuka" dan "lesen terbuka" ialah dua soalan berbeza — dan di sini hanya yang pertama sahaja "ya" yang jelas.

Qwen3.8-Max ialah pratonton, bukan muat turun

Qwen3.8-Max daripada Alibaba ialah tajuk terbesar gelombang ini, sekali gus yang paling lembut. Diperkenalkan pada 19 Julai di WAIC, ia ialah MoE jarang bersaiz 2.4 trilion parameter — bilangan parameter aktif tidak didedahkan — dan Qwen pertama melepasi satu trilion parameter yang multimodal, mampu mengendalikan teks, imej, video dan dokumen. Dan buat masa ini, ia baru sekadar pratonton terhos: qwen3.8-max-preview, ditawarkan pada sekitar 10% harga standard menerusi Token Plan dan Qoder milik Alibaba.

Inilah yang belum tiba: tarikh untuk berat terbuka, lesen, kad model, atau jadual penanda aras bebas. Alibaba berkata beratnya akan tiba "tidak lama lagi", tetapi organisasi Qwen di Hugging Face tiada apa-apa yang baharu sejak Jun. Dakwaan syarikat bahawa model ini "hanya kalah kepada Fable 5" memang begitu adanya — dakwaan sendiri, yang setakat ini tanpa angka pihak ketiga menyokongnya. Anggap ia sebagai baris pemasaran vendor sehingga ada pihak di luar Alibaba mengukurnya.

Satu perkara lagi perlu dinyatakan dengan tepat, kerana ia sudah tersebar seolah-olah fakta: cerita bahawa "Qwen3.8 27B" akan keluar minggu depan ialah khabar angin komuniti. Ia berpunca daripada satu komen di Hacker News dan satu pengagregat yang mengulanginya. Alibaba tidak menyatakan tarikh, saiz, mahupun lesen. Berdasarkan sejarah pelancaran syarikat, ia jangkaan yang munasabah — dan tidak lebih daripada jangkaan.

DeepSeek V4 diam-diam mencapai ketersediaan umum

DeepSeek paling kurang membuat hebahan tetapi menyerahkan yang paling boleh digunakan. Barisan V4, yang dilancarkan sejak 24 April, hadir dalam dua saiz berlesen terbuka: V4-Pro dengan 1.6 trilion keseluruhan dan 49 bilion parameter aktif, serta V4-Flash dengan 284 bilion keseluruhan dan 13 bilion aktif. Kedua-duanya MIT. Kedua-duanya mempunyai tetingkap konteks satu juta token dan tetingkap keluaran sehingga 384K token. Sekitar 20 Julai, V4 mencapai ketersediaan umum dengan penetapan harga berasaskan masa, dan itulah yang menariknya masuk ke bingkai tiga minggu yang sama dengan K3 dan Qwen. Tiada R2, tiada V5, tiada V4.1 — hanya keluarga V4 yang matang menjadi sesuatu yang boleh diharapkan pasukan.

Jurang menguncup lebih pantas daripada yang diakui papan kedudukan

Berundur selangkah, kecerunan lebih penting daripada pelancaran satu per satu. Bacaan Nathan Lambert ialah jarak antara model terbuka terbaik dan model tertutup terbaik telah memampat daripada kira-kira enam hingga sembilan bulan kepada tiga hingga lima — "model terbuka tidak pernah sedekat ini dengan frontier sejak DeepSeek R1". Data penggunaan menunjuk ke arah yang sama. Di OpenRouter, bahagian token model berasal AS jatuh daripada kira-kira 70% pada Jun 2025 kepada sekitar 30% setahun kemudian, sementara model berasal China kini kerap melepasi 30%. Harga ialah sebahagian besar sebabnya: model terbuka China biasanya 60% hingga 90% lebih murah setiap token, dan pengehosan muncul serta-merta — Together AI dan Modal sama-sama menghidupkan endpoint Kimi K3 pada hari sifar.

Peralihan yang lebih senyap ialah tentang skala. Jenama model terbuka China dahulu ialah kecil, pantas, murah. K3 dengan 2.8 trilion parameter dan Qwen3.8-Max dengan 2.4 trilion ialah sebaliknya sama sekali — pertaruhan bahawa berfikir besar dalam ranah terbuka kini berbaloi. GLM-5.2 daripada Z.ai, yang dilancarkan pada 16 Jun di bawah MIT dan mendahului kategori berat terbuka Artificial Analysis Index dengan skor 51, ialah mesej yang sama daripada makmal keempat.

Kelokan: kerajaan yang memungkinkan ini mungkin mengekangnya

Kemudian angin berpaling arah. Sekitar 22 hingga 25 Julai, Financial Times dan Reuters melaporkan bahawa Kementerian Perdagangan China sedang menimbang kawalan eksport ke atas model AI — termasuk LLM berat terbuka — dengan Alibaba, ByteDance dan Z.ai dikatakan turut dalam perbincangan. Rangka kerja yang dibangkitkan bertingkat: kewajipan melapor bagi model yang lebih lemah, semakan keselamatan bagi yang lebih kuat, dan kemungkinan larangan menerbitkan secara terbuka model yang paling berupaya. Tiada apa-apa lagi menjadi undang-undang. Namun arahnya ketara: gelombang ini mungkin sedang memuncak tepat pada saat kerajaannya sendiri mula memperlakukan model-model ini sebagai eksport strategik, bukan sumbangan terbuka.

Kesimpulan: apabila yang terbuka menjadi aset strategik

Cerita yang kemas berbunyi "China telah mengejar". Yang lebih tepat berbunyi: berat terbuka menjadi aset strategik cukup pantas sehingga sebuah kerajaan kini mahu memegang paip. Dalam tiga minggu, model terbuka beralih daripada ketinggalan dua hingga tiga suku di belakang frontier kepada hanya satu — dan daripada kecil dan murah kepada antara model terbesar yang pernah diterbitkan dalam apa jua bentuk. Frontier terbuka bukan sekadar berganjak. Ia berganjak ke tempat yang penciptanya mungkin tidak lagi bebas untuk terus menghantar dari situ.

Bagi pasukan yang membina di atas model-model ini, pengajaran praktikalnya kekal sama dan sedikit lebih tajam. Telli.sh sudah menjalankan model terbuka, Qwen3, dalam lapisan ringkasannya, jadi setiap peningkatan kualiti dan harga model terbuka mengalir terus ke transkripsi mesyuarat, terjemahan dan ringkasan. Item baharunya ialah bekalan: jika peraturan eksport China terbentuk seperti yang dibayangkan laporan, persoalan model terbuka mana yang kekal boleh dimuat turun secara bebas ialah sesuatu yang perlu dipantau, bukan diandaikan. Bahawa model yang menyuap lapisan itu semakin baik ialah aliran; dari mana model-model itu dibenarkan datang ialah perkara yang perlu terus diperhatikan.

Mulakan nota AI langsung

Sumber


Kembali ke blog