Il modello base Qwen3.6-35B-A3B di Alibaba è uscito ad aprile 2026 come MoE sparso da 35 miliardi di parametri totali e circa 3 miliardi attivi per token. Usa 256 esperti (8 routed + 1 shared), un'architettura ibrida Gated DeltaNet + full attention in rapporto 3:1 e supporta nativamente testo, immagini e video con 262K di contesto.
Uncensored + Genesis + Hermes
La variante pubblicata da LuffyTheFox parte dalla versione uncensored HauhauCS Aggressive, che azzera i rifiuti (0 su 465 prompt di test). Su questa base viene applicato l'algoritmo Genesis: una procedura di riparazione statistica dei tensori che elimina blocchi morti, corregge scale drift e rumore di training senza riaddestramento. Vengono poi trasferiti circa 2.000 blocchi da un dataset Hermes per migliorare function calling e stabilità agentic.
Pronto per llama.cpp
Il risultato è un modello GGUF pronto per llama.cpp, LM Studio e runtime compatibili. Le quantizzazioni consigliate sono APEX e Q8_K_P. Resta multimodale (serve il file mmproj per la vision) e mantiene le performance di coding agentico del base, che su SWE-bench Verified arriva al 73,4 %.
Per chi è pensato
Per chi vuole un modello locale capace, multimodale e senza filtri di sicurezza, questa release rappresenta uno dei punti di riferimento attuali della community.
Testo: assistito da AI · revisionato da Carlos H. P. Ross




