ai models

Трёхнедельный рывок открытых весов из Китая: Kimi K3, Qwen3.8-Max и поворот, способный всё оборвать

За три недели крупнейшие AI-лаборатории Китая выпустили или анонсировали открытые модели фронтирного уровня — Kimi K3, Qwen3.8-Max и DeepSeek V4 в общем доступе. Честный разбор: что действительно вышло, что пока лишь обещание и почему Пекин может теперь ограничить волну, которую сам же и запустил.

T
Telli.sh Team
#open-llm#kimi-k3#qwen#deepseek#open-weight#china-ai#ai-models#meeting-notes

С 16 по 26 июля три крупнейшие AI-лаборатории Китая выложили на стол открытые модели фронтирного уровня. Moonshot AI анонсировала Kimi K3 16 июля и выложила веса 26 июля. Alibaba представила Qwen3.8-Max 19 июля на WAIC в Шанхае. Линейка V4 от DeepSeek достигла общего доступа (GA) около 20 июля. Три лаборатории, примерно три недели.

Закономерность трудно не заметить, и это не та, на которой китайская сцена открытых моделей построила свою репутацию. Эти лаборатории были известны маленькими, быстрыми, дешёвыми моделями, которые били выше своей весовой категории. Нынешняя волна — ставка противоположная: системы с триллионами параметров, выпущенные или обещанные как открытые веса.

Это честный разбор той волны: что действительно вышло, что пока лишь превью или обещание, и поворот, пришедший вместе с ней, — то самое правительство, что сделало эти релизы возможными, теперь взвешивает, не ограничить ли их. Если вы читали наш июльский обзор, это продолжение, и одна из его недосказанностей разрешилась.

Ряды шкафов в крупном суперкомпьютерном комплексе

Image: OLCF at ORNL, Wikimedia Commons, CC BY 2.0.

Реально вышла именно Kimi K3

Когда мы писали о Kimi K3 в июле, веса были лишь обещанием — Moonshot AI говорила «до 27 июля». Они пришли 26 июля: 1,56 терабайта в 96 шардах на Hugging Face, под moonshotai/Kimi-K3. Вот это и есть новость. Анонс — это пресс-релиз; скачиваемые веса — факт, на котором можно строить.

Архитектура — крупная модель mixture-of-experts: 2,8 триллиона параметров всего, около 104 миллиардов активных на токен; она маршрутизирует примерно 16 из 896 экспертов через механизм, который Moonshot называет Kimi Delta Attention, с окном контекста в один миллион токенов и заявленным приростом эффективности масштабирования около 2,5x по сравнению с K2. В независимом рейтинге Artificial Analysis она заняла 4-е место из 189 моделей — позади Claude Fable 5 и двух конфигураций GPT-5.6 «Sol», впереди Opus 4.8 и GPT-5.5. Для открытой модели, которую можно скачать, уже само нахождение в такой компании — это история.

Прочитайте лицензию, прежде чем строить вокруг неё бизнес. Kimi K3 — не MIT. Она выходит под собственной «Kimi K3 License», не одобренной OSI, с пунктом о пороге выручки: запускать K3 как движок крупного бизнеса Model-as-a-Service можно лишь по отдельному соглашению с Moonshot. Для большинства команд это ничего не меняет; но для тех, кто строит размещённый продукт в большом масштабе, «открытые веса» и «открытая лицензия» — два разных вопроса, и здесь однозначное «да» только у первого.

Qwen3.8-Max — это превью, а не загрузка

Qwen3.8-Max от Alibaba — самый громкий заголовок волны и одновременно самый мягкий. Представленная 19 июля на WAIC, это разреженная MoE на 2,4 триллиона параметров — число активных не раскрыто — и первая Qwen за пределами триллиона параметров, ставшая мультимодальной: она работает с текстом, изображениями, видео и документами. И пока это лишь размещённое превью: qwen3.8-max-preview, предлагаемое примерно за 10% от стандартной цены через Token Plan и Qoder от Alibaba.

Вот чего пока нет: даты выхода открытых весов, лицензии, карточки модели и независимой таблицы бенчмарков. Alibaba говорит, что веса будут «скоро», но в организации Qwen на Hugging Face с июня не появилось ничего нового. Утверждение компании, что модель «уступает только Fable 5», — именно это и есть: собственная оценка, за которой пока нет сторонних цифр. Считайте это маркетинговой формулировкой вендора, пока кто-то вне Alibaba это не измерит.

Ещё одно стоит сказать точно, потому что это уже расходится как факт: история о том, что «Qwen3.8 27B» выйдет на следующей неделе, — слух сообщества. Он восходит к одному комментарию на Hacker News и одному агрегатору, повторившему его. Alibaba не назвала ни даты, ни размера, ни лицензии. С учётом истории релизов компании это разумное ожидание — и не более чем ожидание.

DeepSeek V4 тихо вышла в общий доступ

DeepSeek объявляла меньше всех, а выдала самое пригодное к работе. Линейка V4, выпущенная ещё 24 апреля, идёт в двух размерах с открытой лицензией: V4-Pro — 1,6 триллиона всего и 49 миллиардов активных параметров, и V4-Flash — 284 миллиарда всего и 13 миллиардов активных. Обе под MIT. У обеих окно контекста в один миллион токенов и окна вывода до 384K токенов. Около 20 июля V4 достигла общего доступа с повременной тарификацией, что и втянуло её в те же три недели, что K3 и Qwen. Нет ни R2, ни V5, ни V4.1 — просто семейство V4 дозревает до того, на что команды могут опереться.

Разрыв сокращается быстрее, чем признают рейтинги

Если отступить на шаг, наклон важнее отдельных релизов. По оценке Nathan Lambert, расстояние между лучшими открытыми и лучшими закрытыми моделями сжалось примерно с шести-девяти месяцев до трёх-пяти — «открытые модели не были так близки к фронтиру со времён DeepSeek R1». Данные об использовании указывают в ту же сторону. На OpenRouter доля токенов у моделей американского происхождения упала примерно с 70% в июне 2025 года до примерно 30% год спустя, тогда как модели китайского происхождения теперь регулярно берут отметку выше 30%. Во многом дело в цене: китайские открытые модели обычно дешевле на 60–90% за токен, и хостинг появился сразу — Together AI и Modal подняли эндпоинты Kimi K3 в день нулевого релиза.

Более тихая перемена — про масштаб. Бренд китайской открытой модели был «маленький, быстрый, дешёвый». K3 на 2,8 триллиона параметров и Qwen3.8-Max на 2,4 триллиона — прямая противоположность: ставка на то, что идти вширь в открытом теперь стоит того. GLM-5.2 от Z.ai, выпущенная 16 июня под MIT и возглавляющая категорию открытых весов в Artificial Analysis Index с показателем 51, — то же послание от четвёртой лаборатории.

Поворот: правительство, сделавшее это возможным, может это ограничить

Затем ветер переменился. Около 22–25 июля Financial Times и Reuters сообщили, что Министерство коммерции Китая взвешивает экспортный контроль над AI-моделями — включая открытые LLM, — и что Alibaba, ByteDance и Z.ai якобы участвуют в обсуждениях. Обсуждаемая схема — многоуровневая: уведомительный порядок для более слабых моделей, проверка безопасности для более сильных и возможный запрет на открытую публикацию самых способных. Пока ничего не стало законом. Но направление показательно: волна, возможно, достигает пика ровно в тот момент, когда её собственное правительство начинает трактовать эти модели как стратегический экспорт, а не как открытый вклад.

Итог: когда открытое становится стратегическим активом

Удобная версия гласит «Китай догнал». Более точная гласит, что открытые веса стали стратегическим активом так быстро, что правительство теперь хочет держать руку на кране. За три недели открытые модели сократили отставание от фронтира с двух-трёх кварталов до одного — и из маленьких и дешёвых превратились в одни из крупнейших моделей, когда-либо опубликованных в любой форме. Открытый фронтир не просто сдвинулся. Он сдвинулся туда, откуда его создатели, возможно, не будут вольны продолжать поставки.

Для команд, строящих на этих моделях, практический вывод не изменился и стал чуть острее. Telli.sh уже использует открытую модель Qwen3 в слое суммаризации, так что каждый выигрыш в качестве и цене открытых моделей напрямую перетекает в расшифровку встреч, перевод и резюме. Новая строка — снабжение: если китайские правила экспорта примут ту форму, на которую указывают сообщения, вопрос о том, какие открытые модели останутся свободно скачиваемыми, — то, за чем стоит следить, а не считать данностью. Улучшение моделей, питающих этот слой, — тренд; а откуда этим моделям позволено приходить — то, с чего не стоит спускать глаз.

Начать живую AI-заметку

Источники


Вернуться в блог