La Cina ha smesso di rincorrere.
Il 16 luglio 2026 Moonshot AI ha rilasciato Kimi K3, un modello Mixture-of-Experts da 2,8 trilioni di parametri totali. Solo 16 esperti su 896 si attivano per ogni token. Context window di un milione di token. Vision nativa. Due innovazioni architetturali — Kimi Delta Attention e Attention Residuals — che migliorano efficienza e velocità di decoding.
Nei test indipendenti di Artificial Analysis il modello ottiene 57,1 punti sull'Intelligence Index, quarto assoluto, dietro solo a Claude Fable 5 e GPT-5.6 Sol, ma davanti a Claude Opus 4.8. Nei benchmark di coding agentic e frontend, invece, Kimi K3 prende il comando: primo posto sull'Arena Frontend Code, numeri superiori o molto vicini ai leader chiusi su Terminal-Bench 2.1, Program Bench e SWE Marathon.
Il prezzo API è decisamente inferiore: circa 3 dollari per milione di token in input e 15 in output, con cache-hit a 0,30. I pesi completi sono attesi entro il 27 luglio 2026 sotto licenza permissiva.
Pochi giorni dopo Alibaba presenta Qwen 3.8, 2,4 trilioni di parametri, multimodale, e dichiara prestazioni "second only to Fable 5". Anche in questo caso i pesi saranno aperti a breve.
Non è più una corsa, è una strategia
Questa non è più una corsa a chi ha il modello più potente in un dato momento. È una partita strategica.
Mentre OpenAI, Anthropic e Google mantengono i loro sistemi chiusi, dietro API e guardrail, le aziende cinesi stanno distribuendo modelli frontier open-weight al resto del mondo. Il risultato è un trasferimento di capacità e di potere di innovazione che non passa più solo per i laboratori americani.
La vera domanda, come emerge dall'analisi di questi rilasci, non è quale modello sia oggi il migliore. È quale strategia vincerà nel lungo periodo: modelli chiusi e proprietari oppure open source sempre più potenti e accessibili.
Nei prossimi mesi vedremo se le big tech americane riusciranno a rispondere con nuovi salti di qualità o se il vantaggio competitivo si sarà già spostato. La Cina non sta più chiedendo permesso. Sta semplicemente rilasciando i modelli.
Testo: assistito da AI · revisionato da Carlos H. P. Ross




