Alibaba ha lanciato oggi Qwen3.8, il nuovo flagship della famiglia Qwen con 2.4 trilioni di parametri.
Secondo il team si tratta di uno dei modelli più potenti disponibili, secondo solo a Fable 5.
La preview Qwen3.8-Max-Preview è già accessibile su Token Plan, Qoder e QoderWork. L'open-weight arriverà a breve.
I test indipendenti
I primi test video forniscono un quadro concreto delle capacità del modello.
Su KingBench ha totalizzato 65/80, arrivando secondo dietro Fable 5.
Ha ottenuto punteggi perfetti (10/10) nel gioco bow-and-arrow, nel problema di matematica complessa e nel task agentico lungo che prevedeva la creazione di un dataset, il fine-tuning di un modello Gemma 2B e una interfaccia web.
La simulazione di una rete ferroviaria complessa in HTML Canvas è stata giudicata la migliore mai vista, superando Fable 5 per dettagli e fluidità.
Punti di forza e debolezze
Non tutti i test sono stati eccellenti.
In un test di dashboard 3D con globo il modello ha faticato a mantenere l'elemento visibile e a correggere autonomamente gli errori, risultando inferiore a Kimi K3 e GLM-5.2.
Tuttavia eccelle nei task creativi e multilingue. Ha generato poesia originale in 79 lingue nello stile di poeti iconici e ha fornito analisi contestuali profonde di immagini e video.
La spinta cinese nel settore AI
Mentre Alibaba avanza con Qwen3.8, anche Kimi K3 (e la sua evoluzione K3.1) stanno mostrando prestazioni di altissimo livello.
Questo conferma che la Cina sta accelerando rapidamente nel panorama dei modelli frontier, aumentando la competizione globale in modo sano e interessante per tutti.
Implicazioni per sviluppatori e aziende
Con l'open-weight in arrivo a breve, questo modello da 2.4T parametri potrebbe cambiare davvero le carte in tavola per chi lavora su fine-tuning, agent e deployment custom su larga scala.
La scala è enorme e serviranno cluster seri, ma l'apertura dei pesi renderà il modello più accessibile alla community.
Stiamo entrando in una fase in cui questi giganti open smettono di essere solo "interessanti" e diventano infrastruttura reale.
Per approfondire: Annuncio ufficiale su X Test KingBench e benchmark dettagliati Test 3D Globe e analisi critica Hands-on test completi
Testo: assistito da AI · revisionato da Carlos H. P. Ross




