Gradually LLM Index
LLMs vergleichen. Ohne Äpfel mit Birnen zu messen.
26 aktuelle Sprachmodelle, 325 direkte Duelle und eine zentrale Datenbasis. Du bekommst Benchmarks aus identischen Messreihen, aktuelle API-Preise und die wichtigsten technischen Daten.
- Modelle
- 26
- direkte Vergleiche
- 325
- aktive Benchmarks
- 78
- aktive Messwerte
- 13.152
Schnelleinstieg
Sechs Duelle, die gerade zählen
Jede Paarseite nutzt dieselbe Datenlogik. Ein Wert erscheint nur, wenn Benchmark, Version, Aufgabe und Testaufbau zusammenpassen.
Auswahl
Die wichtigsten 26 Modelle
Die Auswahl konzentriert sich auf aktuelle Spitzenmodelle und relevante günstigere Varianten. Veraltete Modellgenerationen bleiben außen vor.
Anthropic
OpenAI
xAI
DeepSeek
Moonshot AI
Z.ai
Mistral AI
Xiaomi
Methodik
Ein Vergleich ist nur so gut wie seine Kohorte
Zentrale Datenbank
27 Quellen, 13.152 aktive Messwerte und ein einheitliches Modell-Schema.
Gleicher Testaufbau
Wir vergleichen nur Ergebnisse derselben Benchmark-Version, Aufgabe, Metrik und Vergleichskohorte.
Fehlende Werte bleiben leer
Wenn zwei Modelle keine gemeinsame Messreihe haben, zeigen wir das offen. Es gibt keine Schätzwerte.
Daten statt Siegerliste
Benchmarks, Preise und technische Daten stehen nebeneinander. Der beste Kandidat hängt von deinem Einsatz ab.
Datenbank zuletzt abgerufen am 11.08.2026. Preise haben je Modell einen eigenen Prüfstand und eine verlinkte Primärquelle.