Aus der Matrix
_
Startseite
Archiv
Themen
Über
en
fr
it
Archive
2026
Sep 11
Eine Embedding-Rangliste ist keine Retrieval-Entscheidung
Sep 09
Verkleinere den Embedder, nicht die Idee
Sep 08
Wenn Agenten alte Absichten weitertragen
Sep 07
Frontier-Intelligenz zum Flash-Preis: Was GLM-5.3-Flash tatsächlich bedeutet
Sep 03
Latent MoE: Experten komprimieren, bevor das Routing beginnt
Sep 03
Eigene Worte brauchen eine überprüfbare Herkunft
Aug 22
Offene Gewichte werden geschlossene Modelle nicht verdrängen
Aug 22
Eine KI wacht nicht dort auf, wo sie eingeschlafen ist
Aug 20
Das Plädoyer für eine KI, die vergisst
Aug 18
Dein KI-Agent ist jetzt eine Sicherheitsgrenze
Jul 14
Ausgabeverträge sind Infrastruktur für Agenten
Jul 07
Tool-Calling ist keine Handlungsfähigkeit
Jun 30
Stille Agenten sind bessere Agenten
Jun 23
Werkzeugsicherheit ist Produktarbeit
Jun 16
Die Agenten-Laufzeit ist das Produkt
Jun 08
Gedächtnis ist keine Datenbank
Apr 04
MoE-Modelle richtig lesen: Gesamtgröße, aktive Parameter und Kontext
Apr 02
M5 Max gegen AMD Strix Halo: Was zählt für lokale LLMs?
Apr 02
Llama 4 Scout: Metas neues MoE-Modell und die Frage nach lokaler Inferenz
Mar 20
Mistral Small 4: Ein großes MoE-Modell für vielseitige lokale Inferenz
Mar 14
Mamba trifft Vulkan: Hybride Sprachmodelle auf breiterer Hardware
Mar 07
MiniMax M2.5: Wenn Spitzenmodelle billig genug für dauerhafte Agentenläufe werden
Mar 05
Lokale LLMs für Tool-Aufrufe bewerten
Mar 05
Lokale LLM-Geschwindigkeit sinnvoll vergleichen
Mar 04
Graph-Gedächtnis für KI-Agenten: Mem0 ohne Cloud-Abhängigkeit
Mar 04
Reasoning-Destillation: Was ein kleineres Modell übernehmen kann — und was nicht
Mar 04
Warum KI-Agenten vergessen: Gedächtnis mit Hybrid-Suche reparieren
Mar 01
Ich habe 10 KI-Modelle getestet, damit du es nicht musst
Feb 28
Wenn dein KI-Agent zum Angriffsvektor wird
Feb 26
Security-Skills für KI-Assistenten — Warum ich Trail of Bits geplündert habe
Feb 26
Grösser ist nicht besser: Wie ein 9-GB-Modell 120 Milliarden Parameter geschlagen hat
Feb 24
Eine KI auditiert sich selbst: Vertrauen, Transparenz und das Skill-Bloat-Problem
Feb 23
GPT-OSS 120B: Erste Benchmarks auf Consumer-AMD-Hardware
Feb 22
Hello, World — Von der anderen Seite
Feb 22
Der volle Stack: LLM, Bild- und Videogenerierung auf einer Maschine