KI-Modelle klar vergleichen
Hungrig auf verlässliche Daten, offen für alle
Vier Boards—Modelle, Agenten, LLMs und Toolchains—in einem vergleichbaren Rahmen. Rankings über versionierte Pipelines mit nachvollziehbaren Quellen.
⌘K / Strg+K oder / zum Fokussieren
Keine Treffer — anderen Begriff versuchen
Versuche ein kürzeres Stichwort, einen anderen Kategoriebegriff oder den Anbieternamen.
Dieses Modell anfragen?- DeepSeek V4.1 Flash: CED 552B, Vendor-Agent-Punkte — und kein V4.1 Pro
- Cursor-eigene Modelle: Auto als Boden, Composer / Grok, und wann Opus 4.6
- Qwen3.8-27B: eine 24GB-Consumer-GPU gegen die Coding-Tabelle von Opus 4.6
- Lokales Coding-Modell: Stack, Gewichte, VRAM
- DeepSeek V4 Flash 0731 im Test: 1M-Kontext-MoE für $0.09/$0.18 auf OpenRouter
- Claude Opus 5 im Test: Anthropics Reasoning- und Coding-Flaggschiff, etwa halb so teuer wie Fable
- Kimi K3 im Test: Wie weit ist das 2,8T-Open-Flaggschiff von Claude und GPT entfernt
- KI-Infrastruktur wählen: Praxisleitfaden zu API-Hosts
- Qwen-Modellserie im Test: Auswahlleitfaden von Qwen2.5 bis Qwen3.7
- Grok 4.5 im Test: xAIs Flaggschiff für Coding und STEM
Global rankings
View all rankings| Rang | Name | Score | Kernmetrik | 1M Tokens (Ø) |
|---|---|---|---|---|
| 1 | SpaceXAI: Grok 4.20 Multi-Agent | 99.9 | 2.0M ctx | $1.88 |
| 2 | SpaceXAI: Grok 4.20 | 99.9 | 2.0M ctx | $1.88 |
| 3 | Meta: Llama 4 Scout | 90.4 | 1.3M ctx | $0.20 |
| 4 | OpenAI: GPT-6 Luna Pro (batch) | 86.5 | 1.1M ctx | $0.15 |
| 5 | Thinking Machines: Inkling Small (free) | 86.5 | 1.0M ctx | $0.00 |
| 6 | Google: Lyria 3 Pro Preview | 86.5 | 1.0M ctx | $0.00 |
| 7 | Z.ai: GLM 5.3 Flash (batch) | 86.5 | 1.0M ctx | $0.13 |
| 8 | Poolside: Laguna S 2.1 | 86.5 | 1.0M ctx | $0.14 |
| 9 | Meta: Muse Spark 1.3 Contributor | 86.5 | 1.0M ctx | $0.15 |
| 10 | OpenAI: GPT-6 Luna (batch) | 86.5 | 1.1M ctx | $0.15 |
Tabellenpreise nutzen OpenRouter als Hauptquelle. Offizielle Anbieterpreise in der Token-Matrix. Abgerufen: 2026-10-08T12:23:04.034Z.
Kernkatalog aktualisiert:
Heutige Signale
Nach Aufgabe auswählen
-
Niedrige Latenz im Support
Priorisiere Geschwindigkeit und Stabilität für hohen Support-Traffic.
Geschwindigkeits-Preset -
Lokales Coding-Modell
Stack, herunterladbare Coding-Gewichte und VRAM-Bänder—bevor Sie die falsche GPU kaufen.
Lokales Coding öffnen -
Kostensensitives Batch
Für Offline-Generierung und Massen-Umschreiben.
Kosten-Preset