// loading...
// loading...
STATO: STABILE | ULTIMO_AGGIORNAMENTO: 2026.08.25

Alibaba rilascia Qwen3.8-Max: 2.4 trilioni di parametri (95B attivi), coding autonomo per 10+ giorni e pesi open-source in arrivo la prossima settimana.

MiniMax-M3 è disponibile su Hugging Face: modello MoE nativo multimodale da ~428B parametri (~23B attivi), context 1M token via Sparse Attention e performance frontier su coding e agentic.

DeepSeek-V4-Flash-0731 è in public beta sull'API ufficiale. Capacità Agent superiori al V4-Pro-Preview, stessa MoE 284B/13B, context 1M e pricing da 0,14$.

Inflect Micro v2 è un modello text-to-waveform end-to-end da 9,36M parametri che genera audio 24 kHz in locale su CPU a 6,28× real-time, con UTMOS22 4.395 e 66,2% di preferenza community.

Microsoft Research ha rilasciato Mage-Flow, uno stack da 4 miliardi di parametri capace di generare e modificare immagini a risoluzione nativa fino a 2048 px, con varianti Turbo estremamente veloci e licenza MIT.

Microsoft Research rilascia Fara1.5-27B: computer use agent da 27B parametri che raggiunge il 72,3% su Online-Mind2Web e supera Operator e Gemini. Pesi MIT su Hugging Face.

Anthropic ha ridotto di oltre l'80% il system prompt di Claude Code per i modelli Claude 5 senza perdita di performance. Ecco le nuove direttive ufficiali su come scrivere system prompt, CLAUDE.md e skills.

Baseten ha pubblicato GLM-5.2-Vision-NVFP4, un adattamento che innesta il MoonViT di Kimi sul backbone congelato di GLM-5.2, mantenendo le sue capacità di reasoning e il context da 1M token.

Le conversazioni pubbliche di Claude sono apparse nei risultati di Google a causa della mancanza di tag noindex. Anthropic ha corretto in poche ore. Solo link condivisi esplicitamente.