KI-Modelle im Vergleich.
KI-Modelle im Vergleich bewertet Cloud-Frontier-Modelle (GPT-5.6, Claude Opus 5, Gemini) und lokale Modelle anhand realer Aufgaben aus echten Workflows — nicht nur synthetischer Benchmarks wie MMLU oder GSM8K. Zusätzlich gibt es RAM-Klassen-Empfehlungen für lokale Modelle (16/32/64/128 GB) und Runtime-Framework-Vergleiche (Ollama, MLX, llama.cpp). Die Benchmark-Ergebnisse werden laufend aktualisiert.
Modell-Benchmarks im Internet sind meist synthetisch (MMLU, GSM8K) und haben wenig Aussagekraft für Alltags-Entscheidungen. Diese Kategorie macht es umgekehrt: Reale Aufgaben aus echten Workflows — und vergleicht wie die Modelle dabei abschneiden.
Plus: lokale Modelle nach RAM-Klasse. Welches Modell läuft auf deinem 16-GB-Laptop und welches brauchst du wirklich einen 128-GB-Mac für. Living Docs: Die Benchmark-Ergebnisse werden regelmäßig aktualisiert wenn neue Modelle erscheinen.






