Làn sóng open-weight giữa năm 2026: Kimi K3, GLM-5.2 và lý do các mô hình mở tiếp tục tiến bộ
Kimi K3 là tâm điểm của làn sóng open-weight năm 2026, nhưng mô hình bạn thực sự có thể tải về dùng ngay hôm nay là GLM-5.2. Một góc nhìn trung thực về cả hai và lý do các mô hình mở với giấy phép thoáng lại quan trọng với ghi chú cuộc họp.
Giữa năm 2026 là giai đoạn mạnh mẽ một cách khác thường đối với các mô hình open-weight. Chỉ trong vài tuần, nhiều phòng thí nghiệm đã phát hành hoặc công bố những mô hình đủ sức cạnh tranh với các hệ thống đóng tốt nhất, dưới những giấy phép cho phép bất kỳ ai cũng có thể tự chạy. Tâm điểm là Kimi K3 của Moonshot AI, công bố ngày 16 tháng 7 năm 2026. Còn mô hình bạn thực sự có thể tải về và dùng ngay hôm nay là GLM-5.2 của Z.ai. Cả hai đều đáng tìm hiểu, và sẽ hữu ích khi phân biệt trung thực điều gì đã được xác nhận với điều gì vẫn còn là lời hứa.

Image: Carl Lender, Wikimedia Commons, CC BY 2.0.
Kimi K3 là tâm điểm, nhưng có những lưu ý thực sự
Kimi K3 là một mô hình mở mixture-of-experts rất lớn thuộc lớp 3 nghìn tỷ tham số, được báo cáo với 2,8 nghìn tỷ tham số tổng cộng. Việc phát hành một mô hình quy mô như vậy dưới dạng mô hình mở, chứ không phải một API đóng, chính là điều khiến thông báo này đáng chú ý. Moonshot AI định vị nó là hệ thống ở tầm frontier, và những người kiểm định độc lập đã bắt đầu xác nhận một phần tuyên bố đó.
Điều đáng trích dẫn là các con số độc lập. Trên bảng xếp hạng Arena Frontend Code, Kimi K3 đứng đầu với 1.679, vượt qua Claude Fable 5. Trong bài đánh giá agentic dài hạn của Artificial Analysis, nó đạt Elo 1547, chỉ sau Fable 5, với chi phí khoảng 0,94 đô la mỗi tác vụ. Đối với một mô hình mở, đây là những kết quả mạnh mẽ, đặc biệt là về mặt chi phí.
Những lưu ý cũng nặng ký không kém. Tại thời điểm viết bài, trọng số vẫn chưa thể tải về. Moonshot AI hứa sẽ phát hành chúng "trước ngày 27 tháng 7 năm 2026", nên tại thời điểm công bố, Kimi K3 mở trong ý định hơn là mở trên thực tế. Giấy phép được kỳ vọng là một biến thể Modified-MIT, nhưng điều đó chưa được xác nhận, và chính các điều khoản cụ thể mới quyết định liệu các đội có thực sự xây dựng dựa trên nó được hay không. Các benchmark hàng đầu trong tài liệu ra mắt cũng một phần do chính nhà phát triển tự báo cáo, và đó chính là lý do các con số độc lập của Arena và Artificial Analysis nêu trên là những gì nên dựa vào. Kimi K3 trông giống một bản phát hành thực sự quan trọng, nhưng "quan trọng" và "dùng được cho production hôm nay" không phải là một, và khi lập kế hoạch, nên giữ hai ý này tách bạch.
GLM-5.2 là mô hình bạn có thể dùng ngay hôm nay
Nếu Kimi K3 là tâm điểm, thì GLM-5.2 của Z.ai là điểm tựa. Trọng số của nó đã có sẵn ngay bây giờ dưới giấy phép MIT, và hiện đứng đầu ở nhóm open-weight của Artificial Analysis Intelligence Index v4.1. Sự kết hợp giữa giấy phép thoáng và vị trí độc lập ở đỉnh bảng khiến nó trở thành lựa chọn thực tế cho các đội muốn triển khai một mô hình mở thay vì chỉ đọc về nó.
Thông số kỹ thuật củng cố điều đó. GLM-5.2 là mô hình mixture-of-experts 753 tỷ tham số, với khoảng 40 tỷ tham số hoạt động mỗi token, và hỗ trợ cửa sổ ngữ cảnh 1 triệu token. Trong các bài kiểm tra độc lập, nó vượt GPT-5.5 ở các tác vụ lập trình dài hạn với chi phí chỉ khoảng một phần sáu. Hạn chế chính là nó chỉ xử lý văn bản, nên không nhận đầu vào hình ảnh, âm thanh hay video như một số hệ thống đa phương thức. Dù vậy, với rất nhiều công việc thực tế, một mô hình văn bản hàng đầu với một triệu token ngữ cảnh và giấy phép MIT chính là thứ các đội đã chờ đợi.
Phần còn lại của làn sóng
Kimi K3 và GLM-5.2 là hai cái tên đáng theo dõi, nhưng không phải là duy nhất. DeepSeek V4 Flash là mô hình mở tầm frontier rẻ nhất và phát hành dưới MIT, khiến nó hấp dẫn cho các khối lượng công việc lớn nơi chi phí mỗi token là yếu tố quyết định. MiniMax M3 là đa phương thức và hiện dẫn đầu nhóm open-weight trên SWE-bench Pro, mang lại một lựa chọn mở đáng tin cậy cho các đội cần đầu vào hình ảnh hoặc tài liệu bên cạnh văn bản. Cộng thêm Nemotron 3 Ultra của NVIDIA, Qwen3.6 của Alibaba và Gemma 4 của Google, tổng thể cho thấy trọng số mở không còn kém frontier đóng một bước nữa, mà chỉ vài tuần, và đôi khi thậm chí không kém. Bài học thực tế là "mở" không còn đồng nghĩa với "lựa chọn tốt thứ hai".
Điều quan trọng vượt ra ngoài bảng xếp hạng
Xếp hạng benchmark hữu ích, nhưng câu chuyện bền vững hơn mang tính cấu trúc. Các mô hình mở ngày càng giỏi suy luận ngữ cảnh dài, ngày càng rẻ hơn cho mỗi tác vụ, và ngày càng nhiều mô hình được phát hành dưới giấy phép cho phép triển khai thực sự. Ba xu hướng này cộng hưởng với nhau. Một đội xây dựng trên trọng số mở vào giữa năm 2026 có những mô hình mạnh hơn, chi phí thấp hơn và ít ràng buộc pháp lý hơn so với chỉ một quý trước.
Điều này liên quan trực tiếp đến cách phiên âm, dịch và tóm tắt cuộc họp tiếp tục cải thiện. Telli.sh đã dùng một mô hình mở là Qwen3 trong lớp tóm tắt của mình. Khi hệ sinh thái mở có thêm cửa sổ ngữ cảnh dài hơn, suy luận đa ngôn ngữ mạnh hơn và giấy phép thoáng hơn, lớp mô hình mở bên dưới những sản phẩm như của chúng tôi vừa tốt hơn vừa rẻ hơn cùng lúc. Ngữ cảnh một triệu token không còn là một benchmark trừu tượng khi nó có nghĩa là một cuộc họp dài, một buổi phỏng vấn trọn vẹn hay cả một ngày ghi âm có thể được suy luận trong một lượt. Tất nhiên, nhận dạng giọng nói tốt vẫn cần một lớp sản phẩm biến bản phiên âm thành ghi chú có thể rà soát, quyết định và đầu việc, nhưng các mô hình cấp cho lớp đó đang tiến bộ nhanh hơn một năm trước.
Góc nhìn trung thực
Nếu bạn muốn triển khai thứ gì đó ngay bây giờ, câu trả lời là GLM-5.2: có sẵn, giấy phép MIT và được xếp hạng độc lập ở đỉnh nhóm open-weight. Nếu bạn muốn biết frontier đang đi về đâu, hãy theo dõi Kimi K3 và kiểm tra lại sau ngày 27 tháng 7 năm 2026 xem trọng số và giấy phép có đến đúng như đã hứa không. Dù thế nào, hướng đi cũng đã rõ. Các mô hình mở đang thu hẹp khoảng cách, và lớp sản phẩm được xây dựng trên chúng chính là phần biến năng lực thô thành thứ mà một đội thực sự có thể sử dụng.
Nguồn
- Simon Willison on GLM-5.2 (June 17, 2026)
- Simon Willison on Kimi K3 (July 16, 2026)
- OpenRouter, "The Open Weight Models that Matter: June 2026" (June 27, 2026)
- Tom's Hardware on Kimi K3 (July 2026)
- VentureBeat on GLM-5.2 (June 2026)
- Artificial Analysis on GLM-5.2
- Kimi K3 announcement (Moonshot AI)
- Wikimedia Commons image page