Gelombang open-weight pertengahan 2026: Kimi K3, GLM-5.2 dan sebab model terbuka terus bertambah baik
Kimi K3 ialah tumpuan gelombang open-weight 2026, tetapi model yang benar-benar boleh anda muat turun hari ini ialah GLM-5.2. Satu penilaian jujur terhadap kedua-duanya dan sebab model terbuka berlesen bebas penting untuk nota mesyuarat.
Pertengahan tahun 2026 amat kukuh secara luar biasa bagi model open-weight. Dalam beberapa minggu sahaja, beberapa makmal mengeluarkan atau mengumumkan model yang mampu bersaing dengan sistem tertutup terbaik, di bawah lesen yang membolehkan sesiapa sahaja menjalankannya sendiri. Tumpuannya ialah Kimi K3 daripada Moonshot AI, yang diumumkan pada 16 Julai 2026. Model yang benar-benar boleh anda muat turun dan gunakan hari ini pula ialah GLM-5.2 daripada Z.ai. Kedua-duanya wajar difahami, dan amat membantu untuk memisahkan secara jujur perkara yang telah disahkan dengan perkara yang masih sekadar janji.

Image: Carl Lender, Wikimedia Commons, CC BY 2.0.
Kimi K3 ialah tumpuan, dengan kaveat yang nyata
Kimi K3 ialah model terbuka mixture-of-experts yang sangat besar dalam kelas 3 trilion parameter, dilaporkan mempunyai 2.8 trilion parameter secara keseluruhan. Mengeluarkan model sebesar ini sebagai model terbuka, dan bukan sebagai API tertutup, itulah yang menjadikan pengumuman ini ketara. Moonshot AI meletakkannya sebagai sistem peringkat frontier, dan penguji bebas sudah mula mengesahkan sebahagian daripada dakwaan itu.
Yang wajar dipetik ialah angka bebas. Pada papan pendahulu Arena Frontend Code, Kimi K3 menduduki tempat pertama dengan 1,679, mengatasi Claude Fable 5. Dalam penilaian agentic jangka panjang oleh Artificial Analysis, ia mencapai Elo 1547, hanya di belakang Fable 5, pada kos kira-kira 0.94 dolar setiap tugasan. Bagi sebuah model terbuka, ini keputusan yang kukuh, terutamanya dari segi kos.
Kaveatnya sama beratnya. Pada masa penulisan ini, pemberatnya masih belum boleh dimuat turun. Moonshot AI menjanjikannya "menjelang 27 Julai 2026", jadi pada masa pengumuman Kimi K3 terbuka dari segi niat, bukan dari segi amalan. Lesennya dijangka berupa varian Modified-MIT, tetapi hal itu belum disahkan, dan syarat sebenarnya yang akan menentukan sama ada pasukan benar-benar boleh membina di atasnya. Penanda aras utama dalam bahan pelancaran juga sebahagiannya dilaporkan sendiri oleh pembangun, dan justeru itulah angka bebas Arena serta Artificial Analysis di atas yang wajar dijadikan sandaran. Kimi K3 kelihatan seperti pelancaran yang benar-benar penting, tetapi "penting" dan "boleh digunakan dalam pengeluaran hari ini" bukanlah perkara yang sama, dan sebaiknya kedua-dua idea ini diasingkan semasa merancang.
GLM-5.2 ialah model yang boleh anda guna hari ini
Jika Kimi K3 ialah tumpuan, GLM-5.2 daripada Z.ai ialah sauhnya. Pemberatnya tersedia sekarang di bawah lesen MIT, dan pada masa ini menduduki tempat pertama pada peringkat open-weight dalam Artificial Analysis Intelligence Index v4.1. Gabungan lesen bebas dengan kedudukan bebas di puncak menjadikannya pilihan praktikal bagi pasukan yang mahu menggunakan model terbuka, bukan sekadar membaca tentangnya.
Spesifikasinya menyokong hal itu. GLM-5.2 ialah model mixture-of-experts berparameter 753 bilion, dengan kira-kira 40 bilion parameter aktif setiap token, dan menyokong tetingkap konteks 1 juta token. Dalam ujian bebas, ia mengatasi GPT-5.5 pada tugasan pengekodan jangka panjang dengan kos kira-kira satu perenam. Batasan utamanya ialah ia hanya teks, jadi tidak mengendalikan input imej, audio atau video seperti sesetengah sistem multimodal. Namun begitu, bagi banyak kerja sebenar, sebuah model teks bertaraf tinggi dengan konteks satu juta token dan lesen MIT ialah tepat apa yang dinanti-nantikan oleh banyak pasukan.
Baki gelombang ini
Kimi K3 dan GLM-5.2 ialah dua yang perlu diperhatikan, tetapi bukan satu-satunya. DeepSeek V4 Flash ialah model terbuka peringkat frontier termurah dan dikeluarkan di bawah MIT, menjadikannya menarik untuk beban kerja bervolum tinggi yang menjadikan kos setiap token sebagai penentu. MiniMax M3 pula bersifat multimodal dan kini mendahului kelompok open-weight pada SWE-bench Pro, memberikan pilihan terbuka yang boleh dipercayai kepada pasukan yang memerlukan input imej atau dokumen selain teks. Dengan menambah Nemotron 3 Ultra daripada NVIDIA, Qwen3.6 daripada Alibaba dan Gemma 4 daripada Google, keseluruhannya bermakna pemberat terbuka bukan lagi ketinggalan satu langkah di belakang frontier tertutup, sebaliknya beberapa minggu, dan kadangkala tidak pun. Kesimpulan praktikalnya, "terbuka" tidak lagi bermaksud "pilihan kedua terbaik".
Yang penting di sebalik papan pendahulu
Kedudukan penanda aras berguna, tetapi kisah yang lebih kekal bersifat berstruktur. Model terbuka semakin baik dalam penaakulan konteks panjang, semakin murah setiap tugasan, dan semakin banyak dikeluarkan di bawah lesen yang membenarkan penggunaan sebenar. Ketiga-tiga aliran ini saling menguatkan. Sebuah pasukan yang membina di atas pemberat terbuka pada pertengahan 2026 memiliki model yang lebih berkemampuan, pada kos lebih rendah, dan dengan lebih sedikit kekangan undang-undang berbanding hanya satu suku tahun sebelumnya.
Hal ini secara langsung berkaitan dengan cara transkripsi, terjemahan dan ringkasan mesyuarat terus bertambah baik. Telli.sh sudah menggunakan model terbuka, Qwen3, dalam lapisan ringkasannya. Apabila ekosistem terbuka memperoleh tetingkap konteks lebih panjang, penaakulan berbilang bahasa yang lebih kuat, dan lesen yang lebih bebas, lapisan model terbuka di sebalik produk seperti kami menjadi lebih baik sekali gus lebih murah. Konteks satu juta token berhenti menjadi penanda aras abstrak sebaik sahaja ia bermakna sebuah mesyuarat panjang, satu temu bual penuh, atau rakaman sepanjang hari boleh ditaakul dalam satu pusingan. Sudah tentu, pengecaman pertuturan yang baik masih memerlukan lapisan produk yang menukar transkrip menjadi nota boleh semak, keputusan dan item tindakan, tetapi model yang menyuap lapisan itu bertambah baik jauh lebih pantas berbanding setahun lalu.
Penilaian jujur
Jika anda mahu menggunakan sesuatu sekarang, jawapannya ialah GLM-5.2: tersedia, berlesen MIT, dan diperingkat secara bebas di puncak peringkat open-weight. Jika anda mahu tahu ke mana arah frontier, perhatikan Kimi K3 dan semak semula selepas 27 Julai 2026 sama ada pemberat dan lesennya tiba seperti yang dijanjikan. Walau apa pun, arahnya sudah jelas. Model terbuka sedang merapatkan jurang, dan lapisan produk yang dibina di atasnya ialah bahagian yang menukar keupayaan mentah menjadi sesuatu yang benar-benar boleh digunakan oleh sesebuah pasukan.
Mulakan nota AI secara langsung
Sumber
- Simon Willison on GLM-5.2 (June 17, 2026)
- Simon Willison on Kimi K3 (July 16, 2026)
- OpenRouter, "The Open Weight Models that Matter: June 2026" (June 27, 2026)
- Tom's Hardware on Kimi K3 (July 2026)
- VentureBeat on GLM-5.2 (June 2026)
- Artificial Analysis on GLM-5.2
- Kimi K3 announcement (Moonshot AI)
- Wikimedia Commons image page