La spinta open-weight di metà 2026: Kimi K3, GLM-5.2 e perché i modelli aperti continuano a migliorare
Kimi K3 è il titolo dell'ondata open-weight del 2026, ma il modello che puoi davvero scaricare oggi è GLM-5.2. Una lettura onesta di entrambi e perché i modelli aperti con licenza permissiva contano per le note delle riunioni.
Per i modelli open-weight la metà del 2026 è stata insolitamente forte. Nel giro di poche settimane diversi laboratori hanno pubblicato o annunciato modelli in grado di competere con i migliori sistemi chiusi, sotto licenze che permettono a chiunque di eseguirli. Il titolo è Kimi K3 di Moonshot AI, annunciato il 16 luglio 2026. Il modello che puoi davvero scaricare e usare oggi è GLM-5.2 di Z.ai. Vale la pena capire entrambi, ed è utile distinguere con onestà ciò che è confermato da ciò che è ancora solo una promessa.

Image: Carl Lender, Wikimedia Commons, CC BY 2.0.
Kimi K3 è il titolo, con riserve concrete
Kimi K3 è un grandissimo modello aperto di tipo mixture-of-experts della classe dei 3.000 miliardi di parametri, riportato a 2,8 mila miliardi di parametri totali. Pubblicare un modello di questa scala come modello aperto, e non come API chiusa, è ciò che ha reso notevole l'annuncio. Moonshot AI lo ha posizionato come un sistema di livello frontiera, e i tester indipendenti hanno iniziato a confermarne una parte.
Ciò che vale la pena citare sono i numeri indipendenti. Nella classifica Arena Frontend Code, Kimi K3 si è piazzato al primo posto con 1.679, davanti a Claude Fable 5. Nella valutazione agentica di lungo periodo di Artificial Analysis ha raggiunto un Elo di 1547, dietro al solo Fable 5, a circa 0,94 dollari per attività. Per un modello aperto sono risultati solidi, soprattutto sul fronte dei costi.
Le riserve pesano allo stesso modo. Al momento in cui scriviamo i pesi non sono ancora scaricabili. Moonshot AI li ha promessi "entro il 27 luglio 2026", quindi al momento dell'annuncio Kimi K3 era aperto nelle intenzioni più che nei fatti. Si prevede che la licenza sia una variante Modified-MIT, ma non è confermata, e le condizioni esatte decideranno se i team potranno davvero costruirci sopra. Anche i benchmark di punta del materiale di lancio sono in parte autodichiarati, ed è proprio per questo che i numeri indipendenti di Arena e Artificial Analysis citati sopra sono quelli su cui appoggiarsi. Kimi K3 sembra un rilascio davvero importante, ma "importante" e "utilizzabile in produzione oggi" non sono la stessa cosa, e conviene tenere separate le due idee quando si pianifica.
GLM-5.2 è il modello utilizzabile oggi
Se Kimi K3 è il titolo, GLM-5.2 di Z.ai è l'ancora. I suoi pesi sono disponibili ora sotto licenza MIT, e attualmente occupa il primo posto nel livello open-weight dell'Artificial Analysis Intelligence Index v4.1. Questa combinazione di licenza permissiva e piazzamento indipendente al vertice ne fa la scelta pratica per i team che vogliono distribuire un modello aperto anziché limitarsi a leggerne.
Le specifiche lo confermano. GLM-5.2 è un modello mixture-of-experts da 753 miliardi di parametri, con circa 40 miliardi di parametri attivi per token, e supporta una finestra di contesto da un milione di token. In test indipendenti batte GPT-5.5 sui compiti di codifica di lungo periodo a circa un sesto del costo. Il limite principale è che è solo testuale, quindi non gestisce input di immagini, audio o video come alcuni sistemi multimodali. Eppure, per molto lavoro reale, un modello testuale di primo livello con un milione di token di contesto e licenza MIT è esattamente ciò che i team aspettavano.
Il resto dell'ondata
Kimi K3 e GLM-5.2 sono i due da tenere d'occhio, ma non sono soli. DeepSeek V4 Flash è il più economico dei modelli aperti di livello frontiera e viene rilasciato sotto MIT, il che lo rende attraente per carichi di lavoro ad alto volume in cui il costo per token è decisivo. MiniMax M3 è multimodale e guida attualmente il campo open-weight su SWE-bench Pro, offrendo un'opzione aperta credibile ai team che hanno bisogno di input di immagini o documenti oltre al testo. Aggiungendo Nemotron 3 Ultra di NVIDIA, Qwen3.6 di Alibaba e Gemma 4 di Google, l'insieme significa che i pesi aperti non sono più un passo dietro alla frontiera chiusa, ma poche settimane, e a volte nemmeno quelle. La conclusione pratica è che "aperto" non significa più "seconda scelta".
Ciò che conta oltre le classifiche
Le classifiche dei benchmark sono utili, ma la storia più duratura è strutturale. I modelli aperti migliorano nel ragionamento a contesto lungo, diventano più economici per attività e sempre più spesso vengono rilasciati sotto licenze che permettono un impiego reale. Queste tre tendenze si sommano l'una all'altra. Un team che a metà 2026 costruisce su pesi aperti dispone di modelli più capaci, a costi minori e con meno vincoli legali rispetto anche solo a un trimestre prima.
Tutto questo è direttamente rilevante per il modo in cui trascrizione, traduzione e sintesi delle riunioni continuano a migliorare. Telli.sh usa già un modello aperto, Qwen3, nel suo livello di sintesi. Quando l'ecosistema aperto guadagna finestre di contesto più lunghe, un ragionamento multilingue più forte e licenze più permissive, il livello di modelli aperti sotto prodotti come il nostro diventa al tempo stesso migliore e più economico. Un contesto da un milione di token non è più un benchmark astratto quando significa che una riunione lunga, un'intervista intera o un'intera giornata di registrazioni possono essere ragionate in un solo passaggio. Un buon riconoscimento vocale, naturalmente, ha ancora bisogno di un livello di prodotto che trasformi la trascrizione in note revisionabili, decisioni e azioni, ma i modelli che alimentano quel livello migliorano più velocemente di un anno fa.
La lettura onesta
Se vuoi distribuire qualcosa ora, la risposta è GLM-5.2: disponibile, con licenza MIT e classificato in modo indipendente al vertice del livello open-weight. Se vuoi sapere dove sta andando la frontiera, tieni d'occhio Kimi K3 e ricontrolla, dopo il 27 luglio 2026, se pesi e licenza arrivano come promesso. In ogni caso la direzione è chiara. I modelli aperti stanno colmando il divario, e il livello di prodotto costruito su di essi è la parte che trasforma la capacità grezza in qualcosa che un team può davvero usare.
Fonti
- Simon Willison on GLM-5.2 (June 17, 2026)
- Simon Willison on Kimi K3 (July 16, 2026)
- OpenRouter, "The Open Weight Models that Matter: June 2026" (June 27, 2026)
- Tom's Hardware on Kimi K3 (July 2026)
- VentureBeat on GLM-5.2 (June 2026)
- Artificial Analysis on GLM-5.2
- Kimi K3 announcement (Moonshot AI)
- Wikimedia Commons image page