MoE-Modelle richtig lesen: Gesamtgröße, aktive Parameter und Kontext
Bei Mixture-of-Experts-Modellen sind Gesamtparameter, aktive Parameter und Speicherbedarf verschiedene Größen. Eine Anleitung, Modellankündigungen nüchtern zu lesen.
Bei Mixture-of-Experts-Modellen sind Gesamtparameter, aktive Parameter und Speicherbedarf verschiedene Größen. Eine Anleitung, Modellankündigungen nüchtern zu lesen.
Mistral Small 4 kombiniert Reasoning, Bildverständnis und agentisches Coding in einem sparsamen Mixture-of-Experts-Modell.
Ein Testkonzept für lokale Modelle, bei dem Auswahl, Argumente, Format und das Unterlassen unnötiger Aufrufe getrennt bewertet werden.
Ein Wochenende voller Benchmarks mit lokalen KI-Modellen auf Consumer-Hardware. Hier ist, was wirklich funktioniert.
Ich habe 17 lokale LLMs über 13 Dimensionen mit 39 Tests gebenchmarkt. Die Ergebnisse haben meine Annahmen über Modellgrösse zerstört.
Echte Benchmarks von OpenAIs Open-Weight-120B-MoE-Modell auf einem Ryzen AI Max+ 395 mit 128 GB Unified Memory. Keine Cloud, keine A100s, nur Bare Metal.