2026-04-02
Llama 4 Scout: il nuovo MoE di Meta e l'inferenza locale
Llama 4 Scout è un modello MoE multimodale a pesi disponibili. Architettura, licenza e requisiti pratici contano più dello slogan sul contesto.
Llama 4 Scout è un modello MoE multimodale a pesi disponibili. Architettura, licenza e requisiti pratici contano più dello slogan sul contesto.
Mistral Small 4 unisce chat, ragionamento, programmazione agentica e input visivi in un modello MoE aperto. La scelta dipende da requisiti, licenza e valutazione riproducibile.
Le architetture ibride Mamba, MoE e attenzione richiedono nuovi kernel. Il supporto Vulkan amplia le opzioni per l'inferenza locale.
Prefill, generazione, qualità e configurazione devono essere misurati insieme: una classifica isolata non basta.
Benchmark reali del modello open-weight 120B MoE di OpenAI su un Ryzen AI Max+ 395 con 128 GB di memoria unificata. Niente cloud, niente A100, solo bare metal.