Lo sprint open-weight cinese in tre settimane: Kimi K3, Qwen3.8-Max e la svolta che potrebbe fermare tutto
In tre settimane i maggiori laboratori di IA cinesi hanno pubblicato o annunciato modelli open-weight di frontiera — Kimi K3, Qwen3.8-Max e DeepSeek V4 in disponibilità generale. Una lettura onesta: cosa è uscito davvero, cosa resta una promessa e perché Pechino potrebbe ora limitare l'ondata che ha innescato.
Tra il 16 e il 26 luglio, tre dei maggiori laboratori di IA cinesi hanno messo sul tavolo modelli aperti di livello frontiera. Moonshot AI ha annunciato Kimi K3 il 16 luglio e pubblicato i pesi il 26 luglio. Alibaba ha svelato Qwen3.8-Max il 19 luglio alla WAIC di Shanghai. La linea V4 di DeepSeek ha raggiunto la disponibilità generale (GA) intorno al 20 luglio. Tre laboratori, circa tre settimane.
Lo schema è difficile da ignorare, e non è quello con cui la scena cinese dei modelli aperti si è costruita la reputazione. Questi laboratori erano noti per modelli piccoli, veloci ed economici, che colpivano oltre la loro categoria. Quest'ondata è la scommessa opposta: sistemi da migliaia di miliardi di parametri, pubblicati o promessi come pesi aperti.
Questa è una lettura onesta di quell'ondata: cosa è uscito davvero, cosa resta un'anteprima o una promessa, e la svolta arrivata con essa — lo stesso governo che ha reso possibili questi rilasci sta ora valutando se limitarli. Se hai letto la nostra panoramica di luglio, questo è il seguito, e uno dei suoi fili in sospeso si è sciolto.

Image: OLCF at ORNL, Wikimedia Commons, CC BY 2.0.
Kimi K3 è quello uscito davvero
Quando abbiamo scritto di Kimi K3 a luglio, i pesi erano solo una promessa — Moonshot AI aveva detto «entro il 27 luglio». Sono arrivati il 26 luglio: 1,56 terabyte suddivisi in 96 frammenti su Hugging Face, sotto moonshotai/Kimi-K3. Questa è la notizia. Un annuncio è un comunicato stampa; dei pesi scaricabili sono un fatto su cui costruire.
L'architettura è un grande modello mixture-of-experts — 2,8 trilioni di parametri totali, circa 104 miliardi attivi per token, che instrada all'incirca 16 esperti su 896 tramite un meccanismo che Moonshot chiama Kimi Delta Attention, con una finestra di contesto da un milione di token e un guadagno di efficienza di scaling dichiarato di circa 2,5x rispetto a K2. Nella classifica indipendente di Artificial Analysis si è piazzato 4° su 189 modelli — dietro Claude Fable 5 e due configurazioni GPT-5.6 «Sol», davanti a Opus 4.8 e GPT-5.5. Per un modello aperto che puoi scaricare, stare in quella compagnia è già di per sé la storia.
Leggi la licenza prima di costruirci sopra un business. Kimi K3 non è MIT. Esce con una licenza propria, la «Kimi K3 License», non approvata dall'OSI e con una clausola di soglia di ricavi: usare K3 come motore di un grande servizio Model-as-a-Service richiede un accordo separato con Moonshot. Per la maggior parte dei team non cambia nulla; per chi costruisce un prodotto ospitato su larga scala, «pesi aperti» e «licenza aperta» sono due domande diverse — e qui solo la prima è un sì inequivocabile.
Qwen3.8-Max è un'anteprima, non un download
Il Qwen3.8-Max di Alibaba è il titolo più grande dell'ondata, e anche il più tenero. Presentato il 19 luglio alla WAIC, è un MoE sparso da 2,4 trilioni di parametri — parametri attivi non divulgati — e il primo Qwen oltre il trilione di parametri a essere multimodale, capace di gestire testo, immagini, video e documenti. E per ora è solo un'anteprima ospitata: qwen3.8-max-preview, offerta a circa il 10 % del prezzo standard tramite il Token Plan e Qoder di Alibaba.
Ecco cosa non è arrivato: una data per i pesi aperti, una licenza, una scheda modello o una tabella di benchmark indipendente. Alibaba dice che i pesi arrivano «presto», ma l'organizzazione Qwen su Hugging Face non riceve nulla di nuovo da giugno. L'affermazione dell'azienda secondo cui il modello sarebbe «secondo solo a Fable 5» è esattamente questo — un dato dichiarato dall'azienda, senza numeri di terzi a sostenerlo per ora. Trattalo come lo slogan di marketing di un fornitore finché qualcuno fuori da Alibaba non lo misura.
Un'ultima cosa va detta con precisione, perché circola già come un fatto: la storia di un «Qwen3.8 27B» in uscita la prossima settimana è una voce della community. Risale a un commento su Hacker News e a un aggregatore che l'ha ripreso. Alibaba non ha indicato né data, né dimensione, né licenza. Vista la storia dei rilasci dell'azienda, è un'aspettativa ragionevole — e nulla più di un'aspettativa.
DeepSeek V4 ha raggiunto la disponibilità generale in silenzio
DeepSeek ha annunciato di meno e consegnato la cosa più utilizzabile. La linea V4, pubblicata già il 24 aprile, arriva in due tagli con licenza aperta: V4-Pro, 1,6 trilioni totali e 49 miliardi di parametri attivi, e V4-Flash, 284 miliardi totali e 13 miliardi attivi. Entrambi sono MIT. Entrambi offrono una finestra di contesto da un milione di token e finestre di output fino a 384K token. Intorno al 20 luglio, V4 ha raggiunto la disponibilità generale con un prezzo a tempo, il che l'ha portato nella stessa cornice di tre settimane di K3 e Qwen. Non c'è nessun R2, nessun V5, nessun V4.1 — solo la famiglia V4 che matura in qualcosa su cui i team possono fare affidamento.
Il divario si chiude più in fretta di quanto ammettano le classifiche
Facendo un passo indietro, la pendenza conta più dei singoli rilasci. La lettura di Nathan Lambert è che la distanza tra i migliori modelli aperti e i migliori chiusi si sia compressa da circa sei-nove mesi a tre-cinque — «i modelli aperti non sono mai stati così vicini alla frontiera dai tempi di DeepSeek R1». I dati d'uso vanno nella stessa direzione. Su OpenRouter, la quota di token dei modelli di origine statunitense è scesa da circa il 70 % di giugno 2025 a circa il 30 % un anno dopo, mentre i modelli di origine cinese superano ormai regolarmente il 30 %. Il prezzo pesa molto: i modelli aperti cinesi costano di solito dal 60 al 90 % in meno per token, e l'hosting è comparso subito — Together AI e Modal hanno attivato endpoint per Kimi K3 già il giorno zero.
Il cambiamento più silenzioso riguarda la scala. Il marchio del modello aperto cinese era piccolo, veloce, economico. K3 con 2,8 trilioni di parametri e Qwen3.8-Max con 2,4 trilioni sono esattamente l'opposto — una scommessa sul fatto che ora puntare in grande nell'aperto convenga. GLM-5.2 di Z.ai, pubblicato il 16 giugno sotto MIT e in testa alla categoria open-weight dell'Artificial Analysis Index con 51, è lo stesso messaggio da un quarto laboratorio.
La svolta: il governo che l'ha reso possibile potrebbe limitarlo
Poi il vento è cambiato. Intorno al 22-25 luglio, il Financial Times e Reuters hanno riferito che il Ministero del Commercio cinese sta valutando controlli sulle esportazioni dei modelli di IA — inclusi gli LLM open-weight — con Alibaba, ByteDance e Z.ai presumibilmente coinvolti nelle trattative. Il quadro ipotizzato è a livelli: un obbligo di notifica per i modelli più deboli, una revisione di sicurezza per quelli più forti e un possibile divieto di pubblicazione aperta per i più capaci. Nulla è ancora legge. Ma la direzione è sorprendente: l'ondata potrebbe toccare l'apice proprio nel momento in cui il suo stesso governo comincia a trattare questi modelli come esportazioni strategiche anziché come contributi aperti.
In sintesi: quando l'aperto diventa un asset strategico
La storia comoda dice «la Cina ha recuperato». Quella più accurata dice che i pesi aperti sono diventati un asset strategico così in fretta che un governo vuole ora la mano sul rubinetto. In tre settimane, i modelli aperti sono passati dall'essere due o tre trimestri dietro la frontiera a uno solo — e da piccoli ed economici a essere tra i modelli più grandi mai pubblicati, in qualunque forma. La frontiera aperta non si è solo spostata. Si è spostata in un luogo da cui i suoi creatori potrebbero non essere liberi di continuare a spedire.
Per i team che costruiscono su questi modelli, la conclusione pratica non cambia e si fa un po' più tagliente. Telli.sh usa già un modello aperto, Qwen3, nel suo livello di sintesi, così ogni miglioramento in qualità e prezzo dei modelli aperti confluisce dritto nella trascrizione, nella traduzione e nei riassunti delle riunioni. La voce nuova è l'approvvigionamento: se le regole cinesi sull'export prendono la forma suggerita dalle cronache, quali modelli aperti resteranno liberamente scaricabili è qualcosa da monitorare più che da dare per scontato. Che migliorino i modelli che alimentano quel livello è la tendenza; da dove a quei modelli è concesso arrivare è ciò da tenere d'occhio.
Fonti
- Simon Willison on Kimi K3 weights (July 27, 2026)
- Nathan Lambert, "Kimi K3: the open-weights escalation" (Interconnects, July 20, 2026)
- Kimi K3 announcement (Moonshot AI)
- Kimi K3 weights on Hugging Face
- Artificial Analysis on Kimi K3
- MarkTechPost on Qwen3.8-Max (July 19, 2026)
- WinBuzzer on DeepSeek V4 (April 27, 2026)
- The Decoder on Chinese open-model adoption
- Tom's Hardware on China's proposed AI export controls (July 2026)
- Wikimedia Commons image page