ai models

Lari cepat tiga minggu bobot terbuka China: Kimi K3, Qwen3.8-Max, dan kejutan yang bisa mengakhirinya

Dalam tiga minggu, lab-lab AI terbesar China merilis atau mengisyaratkan model bobot terbuka kelas frontier — Kimi K3, Qwen3.8-Max, dan DeepSeek V4 yang sudah tersedia umum. Ulasan jujur: apa yang benar-benar rilis, apa yang masih janji, dan mengapa Beijing kini mungkin membatasi gelombang yang ia sendiri picu.

T
Telli.sh Team
#open-llm#kimi-k3#qwen#deepseek#open-weight#china-ai#ai-models#meeting-notes

Antara 16 dan 26 Juli, tiga dari lab AI terbesar China menaruh model terbuka kelas frontier di atas meja. Moonshot AI mengumumkan Kimi K3 pada 16 Juli dan merilis bobotnya pada 26 Juli. Alibaba memperkenalkan Qwen3.8-Max pada 19 Juli di WAIC Shanghai. Lini V4 DeepSeek mencapai ketersediaan umum (GA) sekitar 20 Juli. Tiga lab, kira-kira tiga minggu.

Polanya sulit dilewatkan, dan itu bukan pola yang membuat nama besar dunia model terbuka China selama ini. Lab-lab ini dikenal lewat model yang kecil, cepat, dan murah, tetapi memukul di atas kelasnya. Gelombang ini adalah taruhan sebaliknya: sistem triliunan parameter yang dirilis, atau dijanjikan, sebagai bobot terbuka.

Ini adalah ulasan jujur atas gelombang itu: apa yang benar-benar rilis, apa yang masih pratinjau atau janji, dan kejutan yang datang bersamanya — pemerintah yang sama yang memungkinkan rilis-rilis ini kini menimbang apakah harus membatasinya. Jika Anda membaca rangkuman Juli kami, ini adalah sekuelnya, dan salah satu benang yang menggantung kini terurai.

Deretan rak di fasilitas superkomputer besar

Image: OLCF at ORNL, Wikimedia Commons, CC BY 2.0.

Kimi K3 adalah yang benar-benar rilis

Ketika kami menulis tentang Kimi K3 pada Juli, bobotnya masih sebatas janji — Moonshot AI mengatakan "paling lambat 27 Juli". Bobot itu tiba pada 26 Juli: 1,56 terabyte dalam 96 pecahan di Hugging Face, di bawah moonshotai/Kimi-K3. Itulah beritanya. Pengumuman adalah siaran pers; bobot yang bisa diunduh adalah fakta yang bisa Anda bangun di atasnya.

Arsitekturnya adalah model mixture-of-experts besar — 2,8 triliun parameter total, sekitar 104 miliar aktif per token, merutekan kira-kira 16 dari 896 pakar melalui mekanisme yang Moonshot sebut Kimi Delta Attention, dengan jendela konteks satu juta token dan peningkatan efisiensi penskalaan yang dilaporkan sekitar 2,5x dibanding K2. Pada peringkat independen Artificial Analysis, ia menempati posisi ke-4 dari 189 model — di belakang Claude Fable 5 dan dua konfigurasi GPT-5.6 "Sol", di depan Opus 4.8 dan GPT-5.5. Bagi model terbuka yang bisa Anda unduh, berada di lingkaran itu saja sudah menjadi cerita tersendiri.

Baca lisensinya sebelum merancang bisnis di sekitarnya. Kimi K3 bukan MIT. Ia rilis di bawah lisensi khusus "Kimi K3 License" yang tidak disetujui OSI dan memuat klausul ambang pendapatan: menjalankan K3 sebagai mesin bisnis Model-as-a-Service besar mensyaratkan perjanjian terpisah dengan Moonshot. Bagi kebanyakan tim itu tidak mengubah apa pun; tetapi bagi siapa pun yang membangun produk ter-hosting berskala besar, "bobot terbuka" dan "lisensi terbuka" adalah dua pertanyaan berbeda — dan di sini hanya yang pertama yang jelas-jelas "ya".

Qwen3.8-Max adalah pratinjau, bukan unduhan

Qwen3.8-Max dari Alibaba adalah judul terbesar gelombang ini, sekaligus yang paling lunak. Diperkenalkan pada 19 Juli di WAIC, ia adalah MoE renggang berukuran 2,4 triliun parameter — jumlah parameter aktif tidak diungkap — dan Qwen pertama di atas satu triliun parameter yang multimodal, mampu menangani teks, gambar, video, dan dokumen. Dan untuk saat ini, ia baru sebatas pratinjau ter-hosting: qwen3.8-max-preview, ditawarkan sekitar 10% dari harga standar melalui Token Plan dan Qoder milik Alibaba.

Inilah yang belum tiba: tanggal untuk bobot terbuka, lisensi, kartu model, atau tabel tolok ukur independen. Alibaba mengatakan bobotnya akan datang "segera", tetapi organisasi Qwen di Hugging Face tak menerima apa pun yang baru sejak Juni. Klaim perusahaan bahwa model ini "hanya kalah dari Fable 5" persis begitu adanya — klaim sepihak, yang sejauh ini tanpa angka pihak ketiga sebagai penopang. Perlakukan itu sebagai baris pemasaran vendor sampai ada yang di luar Alibaba mengukurnya.

Satu hal lagi perlu dikatakan dengan cermat, karena sudah menyebar seolah fakta: cerita bahwa "Qwen3.8 27B" akan rilis minggu depan adalah rumor komunitas. Ia berakar dari satu komentar di Hacker News dan satu agregator yang mengulanginya. Alibaba tidak menyebut tanggal, ukuran, maupun lisensi. Mengingat riwayat rilis perusahaan, itu ekspektasi yang masuk akal — dan tak lebih dari sekadar ekspektasi.

DeepSeek V4 diam-diam mencapai ketersediaan umum

DeepSeek paling sedikit berkoar tetapi mengirimkan yang paling bisa dipakai. Lini V4, yang dirilis sejak 24 April, hadir dalam dua ukuran berlisensi terbuka: V4-Pro dengan 1,6 triliun total dan 49 miliar parameter aktif, serta V4-Flash dengan 284 miliar total dan 13 miliar aktif. Keduanya MIT. Keduanya memiliki jendela konteks satu juta token dan jendela keluaran hingga 384K token. Sekitar 20 Juli, V4 mencapai ketersediaan umum dengan penetapan harga berbasis waktu, dan itulah yang menariknya masuk ke bingkai tiga minggu yang sama dengan K3 dan Qwen. Tidak ada R2, tidak ada V5, tidak ada V4.1 — hanya keluarga V4 yang matang menjadi sesuatu yang bisa diandalkan tim.

Jarak menyempit lebih cepat dari yang diakui papan peringkat

Bila mundur selangkah, kemiringannya lebih penting ketimbang rilis satu per satu. Bacaan Nathan Lambert: jarak antara model terbuka terbaik dan model tertutup terbaik telah memampat dari sekitar enam hingga sembilan bulan menjadi tiga hingga lima — "model terbuka tidak pernah sedekat ini dengan frontier sejak DeepSeek R1". Data penggunaan menunjuk ke arah yang sama. Di OpenRouter, pangsa token model asal AS jatuh dari sekitar 70% pada Juni 2025 menjadi sekitar 30% setahun kemudian, sementara model asal China kini rutin melewati 30%. Harga jadi alasan besar: model terbuka China umumnya 60% hingga 90% lebih murah per token, dan hosting muncul seketika — Together AI dan Modal sama-sama menyalakan endpoint Kimi K3 pada hari nol.

Pergeseran yang lebih senyap adalah soal skala. Merek model terbuka China dulu adalah kecil, cepat, murah. K3 dengan 2,8 triliun parameter dan Qwen3.8-Max dengan 2,4 triliun justru kebalikannya — taruhan bahwa berpikir besar di ranah terbuka kini sepadan. GLM-5.2 dari Z.ai, yang rilis 16 Juni di bawah MIT dan memimpin kategori bobot terbuka Artificial Analysis Index dengan skor 51, adalah pesan yang sama dari lab keempat.

Kejutan: pemerintah yang memungkinkan ini bisa membatasinya

Lalu angin berbalik arah. Sekitar 22 hingga 25 Juli, Financial Times dan Reuters melaporkan bahwa Kementerian Perdagangan China sedang menimbang kontrol ekspor atas model AI — termasuk LLM bobot terbuka — dengan Alibaba, ByteDance, dan Z.ai disebut ikut dalam pembicaraan. Kerangka yang diapungkan bertingkat: kewajiban pelaporan untuk model yang lebih lemah, tinjauan keamanan untuk yang lebih kuat, dan kemungkinan larangan merilis secara terbuka model yang paling mampu. Belum ada yang menjadi undang-undang. Namun arahnya mencolok: gelombang ini mungkin sedang di puncaknya tepat saat pemerintahnya sendiri mulai memperlakukan model-model ini sebagai ekspor strategis, bukan kontribusi terbuka.

Intinya: ketika yang terbuka menjadi aset strategis

Cerita yang rapi berbunyi "China menyusul". Cerita yang lebih akurat berbunyi: bobot terbuka menjadi aset strategis begitu cepat sampai-sampai sebuah pemerintah kini ingin memegang keran. Dalam tiga minggu, model terbuka bergerak dari tertinggal dua-tiga kuartal di belakang frontier menjadi satu kuartal saja — dan dari kecil dan murah menjadi salah satu model terbesar yang pernah dipublikasikan dalam bentuk apa pun. Frontier terbuka tidak sekadar bergeser. Ia bergeser ke tempat yang pembuatnya mungkin tak lagi bebas untuk terus mengirim dari sana.

Bagi tim yang membangun di atas model-model ini, kesimpulan praktisnya tetap sama dan sedikit lebih tajam. Telli.sh sudah menjalankan model terbuka, Qwen3, di lapisan ringkasannya, sehingga setiap peningkatan kualitas dan harga model terbuka mengalir langsung ke transkripsi rapat, penerjemahan, dan ringkasan. Item barunya adalah pasokan: jika aturan ekspor China mendarat seperti yang diisyaratkan laporan, pertanyaan model terbuka mana yang tetap bebas diunduh adalah hal yang perlu dipantau, bukan diandaikan. Bahwa model yang memberi makan lapisan itu terus membaik adalah tren; dari mana model-model itu boleh datang adalah hal yang perlu terus diawasi.

Mulai catatan AI langsung

Sumber


Kembali ke blog