Ich nutze Claude fast täglich. Für Texte, für Code, für Recherche. Und ja, auch dieser Artikel wurde mit Claudes Hilfe erstellt.
Seit dem ersten Release im März 2023 hat Anthropic über 20 Modelle veröffentlicht. Vom kompakten Haiku bis zum Spitzenmodell Fable 5.
Das Problem? Bei mittlerweile über 20 verschiedenen Modellen ist es nicht ganz einfach, den Überblick zu behalten.
In diesem Artikel erkläre ich dir alle Claude-Modelle, ihre Features, Preise und wofür du sie am besten einsetzt.
- Claude Fable 5 (Mythos-Klasse) ist seit Anfang Juli 2026 wieder verfügbar und bleibt Anthropics leistungsstärkstes Modell. Für agentisches Coding und Enterprise-Einsatz ist seit dem 24. Juli 2026 aber Claude Opus 5 die empfohlene Wahl: nahe an Fable 5 zum halben Preis (5 $ Input, 25 $ Output pro Million Token), mit 1 Mio. Token Kontext und Wissensstand Mai 2026. Der Vorgänger Claude 4.8 Opus (88,6 % im SWE-bench Verified) gilt jetzt als Legacy-Modell
- Claude Sonnet 5 (Ende Juni 2026) ist das neue Standard-Modell für Free- und Pro-Nutzer, mit 1 Mio. Token Kontext zum Einführungspreis von 2 $/10 $ pro Million Token bis Ende August 2026
- Alle modernen Claude-Modelle (ab Version 3) haben mindestens 200.000 Token Kontextfenster und multimodale Fähigkeiten für Text und Bilder
Was sind Claude-Modelle?
Claude-Modelle sind fortschrittliche Large Language Models, die von Anthropic mit einem besonderen Fokus auf Sicherheit und Hilfsbereitschaft entwickelt wurden.
Was Claude von anderen KI-Modellen unterscheidet:
- Constitutional AI: Claude wird mit einem Satz von Prinzipien trainiert, die sicherstellen, dass die Antworten hilfreich, harmlos und ehrlich sind. Mehr Details in Anthropics Constitutional AI Forschung.
- Große Kontextfenster: Moderne Claude-Modelle können bis zu 1 Million Token verarbeiten (Fable 5, Sonnet 5, Opus 5, Opus 4.8, 4.7 und die 4.6-Modelle), ältere Modelle ab Version 3 bieten 200.000 Token
- Multimodale Fähigkeiten: Ab Claude 3 können die Modelle sowohl Text als auch Bilder verstehen und analysieren.
- Hybrid Reasoning: Die neuesten Modelle bieten sowohl schnelle Antworten als auch tieferes „Nachdenken“ für komplexe Probleme.
Anthropic hat bewusst eine andere Strategie als OpenAI gewählt: Statt auf maximale Leistung zu setzen, steht die Sicherheit und Kontrolle der KI im Vordergrund.
Bevor wir uns die einzelnen Modelle anschauen, hier die wichtigsten Meilensteine der Claude-Entwicklung von 2023 bis heute im Überblick.
Vergleich aller Claude-Modelle
Hier ist eine detaillierte Übersicht aller Claude-Modelle mit ihren wichtigsten Eigenschaften:
Modell | Veröffentlichung | Status | Input | Output | Cache Write | Cache Read |
|---|---|---|---|---|---|---|
| Claude 3 Haiku | 03/2024 | Eingestellt | 0,25 $ | 1,25 $ | 0,3 $ | 0,03 $ |
| Claude 3.5 Sonnet | 06/2024 | Eingestellt | 3 $ | 15 $ | 3,75 $ | 0,3 $ |
| Claude 3.5 Haiku | 11/2024 | Eingestellt | 0,8 $ | 4 $ | 1 $ | 0,08 $ |
| Claude 3.7 Sonnet | 02/2025 | Eingestellt | 3 $ | 15 $ | 3,75 $ | 0,3 $ |
| Claude 4 Sonnet | 05/2025 | Eingestellt | 3 $ | 15 $ | 3,75 $ | 0,3 $ |
| Claude 4 Opus | 05/2025 | Eingestellt | 15 $ | 75 $ | 18,75 $ | 1,5 $ |
| Claude 4.1 Opus | 08/2025 | Eingestellt | 15 $ | 75 $ | 18,75 $ | 1,5 $ |
| Claude 4.5 Sonnet | 09/2025 | Aktiv | 3 $ | 15 $ | 3,75 $ | 0,3 $ |
| Claude 4.5 Haiku | 10/2025 | Aktiv | 1 $ | 5 $ | 1,25 $ | 0,1 $ |
| Claude 4.5 Opus | 11/2025 | Aktiv | 5 $ | 25 $ | 6,25 $ | 0,5 $ |
| Claude 4.6 Opus | 02/2026 | Aktiv | 5 $ | 25 $ | 6,25 $ | 0,5 $ |
| Claude 4.6 Sonnet | 02/2026 | Aktiv | 3 $ | 15 $ | 3,75 $ | 0,3 $ |
| Claude 4.7 Opus | 04/2026 | Aktiv | 5 $ | 25 $ | 6,25 $ | 0,5 $ |
| Claude Opus 5 | 07/2026 | Aktiv | 5 $ | 25 $ | 6,25 $ | 0,5 $ |
| Claude 4.8 Opus | 05/2026 | Legacy | 5 $ | 25 $ | 6,25 $ | 0,5 $ |
| Claude Sonnet 5 | 06/2026 | Aktiv | 2 $ | 10 $ | 2,5 $ | 0,2 $ |
| Claude Fable 5 | 06/2026 | Aktiv | 10 $ | 50 $ | 12,5 $ | 1 $ |
Fable 5 führt SWE-bench, Opus 4.7 gewinnt GPQA Diamond
Noch aufschlussreicher wird es, wenn man die Coding-Leistung ins Verhältnis zum API-Preis setzt und mit GPT und Gemini vergleicht.
Claude Fable 5 und Claude Mythos 5
Veröffentlicht: Juni 2026Claude Fable 5 und Claude Mythos 5 bilden seit dem 9. Juni 2026 eine neue Tier-Stufe über der Opus-Klasse, die Anthropic als „Mythos-class“ bezeichnet. Beide Modelle teilen sich denselben Unterbau und dieselben Spezifikationen. Der Unterschied liegt in den Sicherheits-Klassifikatoren.
Hauptmerkmale
- 1 Million Token Kontextfenster und 128.000 Output-Token
- Adaptive Thinking als einziger Reasoning-Modus, gesteuert über den Effort-Parameter
- Safety Classifiers bei Fable 5: bei klassifizierten Refusals fällt die API auf ein anderes Claude-Modell (Standard: Opus 4.8) zurück und die Refusal-Antwort wird nicht abgerechnet
- 30 Tage Datenaufbewahrung (Zero-Data-Retention nicht verfügbar, Covered Models)
- Roher Chain-of-Thought wird nicht zurückgegeben, nur eine Zusammenfassung über `thinking.display`
- API-Preise: 10 $ pro 1 Million Input-Token, 50 $ pro 1 Million Output-Token (doppelt so teuer wie Opus 4.8)
Fable 5 vs. Mythos 5: der Unterschied
Claude Fable 5 ist das frei zugängliche Modell mit aktiven Sicherheits-Klassifikatoren. Es ist über die Claude API, Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry und die Claude-Plattform auf AWS verfügbar.
Claude Mythos 5 ist dasselbe Modell ohne diese Klassifikatoren. Es ist nur über das Anthropic-Programm Project Glasswing zugänglich, für autorisierte Kunden aus den Bereichen Cybersecurity, biomedizinische Forschung und kritische Infrastruktur. Wer keinen Glasswing-Zugang hat, nutzt Fable 5.
Kurze Aussetzung im Juni, seit 1. Juli wieder verfügbar
Wenige Tage nach dem Launch stoppte eine US-Exportkontroll-Anordnung den Zugang zu Fable 5 und Mythos 5 vorübergehend, nachdem Sicherheitsforscher einen Jailbreak gefunden hatten. Seit dem 1. Juli 2026 ist der Zugang wieder freigegeben. Für Abo-Tarife (Pro, Max, Team und Enterprise) war Fable 5 zwischen dem 9. und 22. Juni ohne Aufpreis verfügbar, danach war eine Abrechnung über Usage-Credits vorgesehen.
Claude Sonnet 5
Veröffentlicht: 30. Juni 2026Claude Sonnet 5 ist seit dem 30. Juni 2026 das neue Standard-Modell für Free- und Pro-Nutzer in den Claude-Apps und löst Claude 4.6 Sonnet als empfohlenes Sonnet-Modell ab. Laut Anthropic rivalisiert es bei niedrigeren Kosten mit Opus 4.8.
Hauptmerkmale
- 1 Million Token Kontextfenster und 128.000 Output-Token, jetzt auch als Standard in den Claude-Apps
- Adaptive Thinking mit Effort-Parameter, standardmäßig auf „high“
- Neuer Tokenizer (derselbe wie bei Opus 4.7): etwa 30 % mehr Token für denselben Text als bei älteren Sonnet-Modellen
- Kein Priority Tier verfügbar
- Knowledge Cutoff: Januar 2026
- API-Preise: Einführungspreis 2 $ pro 1 Million Input-Token, 10 $ pro 1 Million Output-Token (gültig bis 31. August 2026), danach 3 $ pro 1 Million Input-Token, 15 $ pro 1 Million Output-Token
Was macht Claude Sonnet 5 besonders?
Sonnet 5 ist jetzt das Modell, das die meisten Claude-Nutzer im Alltag zu sehen bekommen, weil es Free- und Pro-Tarife standardmäßig antreibt. Für den Preis eines Sonnet-Modells bekommst du damit ein 1-Millionen-Token-Kontextfenster, das bisher den Opus-Modellen vorbehalten war.
Verfügbarkeit: Claude Sonnet 5 ist verfügbar über die Claude API, Claude.ai Web-Interface, Claude iOS und Android Apps.
Claude Opus 5
Veröffentlicht: 24. Juli 2026Claude Opus 5 ist Anthropics neues Modell für komplexes agentisches Coding und Enterprise-Arbeit und löst Claude 4.8 Opus als empfohlenes Opus-Modell ab. Anthropic beschreibt es als „nahe an der Intelligenz von Claude Fable 5, zum halben Preis“. Fable 5 bleibt damit das Modell mit der höchsten Fähigkeitsstufe, Opus 5 ist die günstigere Wahl knapp darunter fürs Coding.
Hauptmerkmale
- 1 Million Token Kontextfenster und 128.000 Output-Token (bis zu 300.000 über die Batch-Beta)
- Wissensstand Mai 2026, der aktuellste aller Claude-Modelle
- Neues Standardmodell auf Claude Max, stärkstes verfügbares Modell auf Claude Pro
- Führt Frontier-Bench v0.1 an und übertrifft Fable 5 im OSWorld-2.0-Benchmark bei rund einem Drittel der Kosten
- CursorBench 3.2: innerhalb von 0,5 % von Fable 5
- API-Preise: 5 $ pro 1 Million Input-Token, 25 $ pro 1 Million Output-Token (halb so teuer wie Fable 5, gleich teuer wie das abgelöste Opus 4.8). Fast Mode: doppelter Basispreis, Batch API: 2,50 $ / 12,50 $
Was macht Claude Opus 5 besonders?
Der praktische Kern ist das Preis-Leistungs-Verhältnis: Opus 5 kommt laut Anthropic nahe an die Fähigkeiten von Fable 5 heran, kostet aber nur die Hälfte. Gegenüber Opus 4.8 spricht Anthropic von „deutlich verbesserter Leistung zum gleichen Preis“. Bei ARC-AGI 3 erreicht Opus 5 laut Anthropic etwa die dreifache Punktzahl des nächstbesten Modells, bei Zapier AutomationBench rund das 1,5-Fache. In der Chemie legt es gegenüber Opus 4.8 um 10,2 Prozentpunkte zu, bei proteinbezogenen Aufgaben um 7,7 Prozentpunkte. Bei Cybersecurity-Aufgaben liegt Opus 5 weiterhin hinter Claude Mythos 5. Eine offizielle SWE-bench-Verified-Zahl hat Anthropic für Opus 5 bislang nicht veröffentlicht.
Verfügbarkeit: Claude Opus 5 ist verfügbar über die Claude API, Claude.ai Web-Interface, Claude iOS und Android Apps sowie als neues Standardmodell auf Claude Max und stärkstes Modell auf Claude Pro.
Claude 4.8 Opus
Veröffentlicht: Mai 2026Claude 4.8 Opus war von Mai bis Juli 2026 Anthropics empfohlenes Modell für agentisches Coding und Enterprise-Einsatz, bevor es von Claude Opus 5 abgelöst wurde. Es gilt inzwischen als Legacy-Modell, bleibt aber weiterhin verfügbar. Der Sprung gegenüber Opus 4.7 fiel kleiner aus als der von 4.6 auf 4.7, war aber spürbar: Der größte Zugewinn lag erneut beim Coding, mit 88,6 % im SWE-bench Verified (gegenüber 87,6 % bei 4.7) und 69,2 % im anspruchsvolleren SWE-bench Pro (gegenüber 64,3 %).
Hauptmerkmale
- 1 Million Token Kontextfenster und 128.000 Output-Token, wie schon bei Opus 4.7
- Dynamic Workflows: Claude kann in einer einzigen Session hunderte parallele Subagenten starten und damit sehr große Aufgaben zerlegen
- Effort Control: Du steuerst selbst, wie viel Aufwand Claude in eine Aufgabe steckt (Standard ist die Stufe „high“)
- Günstigerer Fast Mode: arbeitet mit 2,5-facher Geschwindigkeit und ist dreimal günstiger als bei früheren Modellen
- 88,6 % im SWE-bench Verified, 69,2 % im SWE-bench Pro, 93,6 % in GPQA Diamond
- API-Preise: 5 $ pro 1 Million Input-Token, 25 $ pro 1 Million Output-Token (unverändert zu Opus 4.7)
Was macht Claude 4.8 Opus besonders?
Der praktisch wichtigste Fortschritt war die Zuverlässigkeit beim Coding.
Laut Anthropic lässt Opus 4.8 etwa viermal seltener Fehler im selbst geschriebenen Code unkommentiert durchgehen als sein Vorgänger. Zusammen mit Dynamic Workflows und der Effort-Steuerung machte 4.8 das vor allem für lange, agentische Coding- und Recherche-Aufgaben zur besten Wahl, bis Opus 5 nachfolgte. Beim reinen Faktenwissen liegt es ungefähr gleichauf mit 4.7, in GPQA Diamond mit 93,6 % sogar minimal darunter (94,2 % bei 4.7). Der Zugewinn steckte klar im agentischen Arbeiten, nicht im Wissen.
Verfügbarkeit: Claude 4.8 Opus ist verfügbar über die Claude API, Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry sowie die Claude-Apps.
Claude 4.7 Opus
Veröffentlicht: April 2026Claude 4.7 Opus war von April bis Mai 2026 das Flaggschiff von Anthropic und ist weiterhin aktiv und einsatzfähig. Es baute direkt auf Opus 4.6 auf und sprang bei der Coding-Leistung deutlich nach vorne: 87,6 % im SWE-bench Verified (gegenüber 80,8 % bei 4.6) und 64,3 % im anspruchsvolleren SWE-bench Pro.
Hauptmerkmale
- 1 Million Token Kontextfenster: 1M-Kontext ist jetzt Standard, nicht mehr Beta
- 128.000 Output-Token
- Neuer Tokenizer: Derselbe Text wird in 1,0 bis 1,35-mal so viele Token zerlegt, was die reale Rechnung bei gleichem Preis pro Token etwas erhöhen kann
- „xhigh“-Reasoning-Modus: Neue Effort-Stufe zwischen „high“ und „max“ für feinere Kontrolle über Denktiefe
- Bildauflösung bis 3,75 MP: Über dreimal so hoch wie bei früheren Claude-Modellen, Bilder bis 2.576 Pixel auf der langen Kante
- 87,6 % im SWE-bench Verified, 94,2 % in GPQA Diamond, 78 % in OSWorld-Verified, 92,4 % in MMLU
- API-Preise: 5 $ pro 1 Million Input-Token, 25 $ pro 1 Million Output-Token (unverändert zu 4.6, aber ohne die Tiered-Pricing-Aufschläge über 200K)
Was macht Claude 4.7 Opus besonders?
Opus 4.7 ist das erste Claude-Modell, das 1M-Kontext zu Standardpreisen ohne Zuschlag über 200K bietet. Das senkt die Kosten für sehr lange Dokumente und Codebasen spürbar. Der Sprung bei SWE-bench Verified von 80,8 % auf 87,6 % war der größte Schritt innerhalb einer Minor-Version seit Jahren und machte Opus 4.7 lange zur besten Wahl für anspruchsvolle Programmieraufgaben, bis Opus 4.8 nachlegte. Der „xhigh“-Modus ist weiterhin besonders für komplexe Reasoning-Probleme nützlich, bei denen „high“ zu flach und „max“ zu langsam ist.
Wichtig zu wissen: Der neue Tokenizer führt dazu, dass derselbe Input 0 bis 35 % mehr Token verbraucht als bei 4.6. Der Preis pro Token bleibt gleich, die tatsächlichen Kosten können je nach Inhalt aber leicht steigen.
Verfügbarkeit: Claude 4.7 Opus ist verfügbar über die Claude API, Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry sowie die Claude-Apps.
Claude 4.6 Opus
Veröffentlicht: Februar 2026Claude 4.6 Opus war bei seinem Release das leistungsstärkste Modell von Anthropic. Es stellte einen Generationssprung dar, indem es erstmals ein Kontextfenster von 1 Million Token bot und mit Agent Teams eine völlig neue Dimension der agentenbasierten KI-Nutzung eröffnete. Inzwischen wurde es von Claude 4.7 Opus abgelöst, bleibt aber weiterhin aktiv und einsatzfähig.
Hauptmerkmale
- 1 Million Token Kontextfenster: Fünfmal so groß wie bei Vorgängermodellen
- 128.000 Output-Token: Doppelt so viel wie bei früheren Opus-Modellen
- Agent Teams: Kann mehrere Aufgaben parallel bearbeiten und koordinieren
- 80,8 % im SWE-bench Verified: Neue Bestmarke unter allen Claude-Modellen
- Multimodale Fähigkeiten: Verarbeitet Text, Bilder und Dokumente
- API-Preise: 5 $ pro 1 Million Input-Token, 25 $ pro 1 Million Output-Token
Was macht Claude 4.6 Opus besonders?
Das 1-Million-Token-Kontextfenster ermöglicht die Verarbeitung extrem großer Codebasen, ganzer Dokumentensammlungen oder umfangreicher Datenanalysen in einem einzigen Durchgang. In Kombination mit Agent Teams können komplexe Projekte aufgeteilt und parallel bearbeitet werden, was die Produktivität bei großen Entwicklungsprojekten erheblich steigert.
Verfügbarkeit: Claude 4.6 Opus ist verfügbar über die Claude API, Claude.ai Web-Interface, Claude iOS und Android Apps.
Claude 4.6 Sonnet
Veröffentlicht: Februar 2026Claude 4.6 Sonnet ist das neueste Standard-Modell von Anthropic und bietet Opus-nahe Leistung zu den gewohnten Sonnet-Preisen. Es teilt das neue 1-Million-Token-Kontextfenster mit dem Opus-Pendant und eignet sich hervorragend als Allround-Modell.
Hauptmerkmale
- 1 Million Token Kontextfenster: Gleiche Kontextgröße wie Claude 4.6 Opus
- 79,6 % im SWE-bench Verified: Opus-nahe Leistung zum Sonnet-Preis
- Standard-Modell: Empfohlenes Modell für die meisten Anwendungsfälle
- Multimodale Fähigkeiten: Verarbeitet Text, Bilder und Dokumente
- API-Preise: 3 $ pro 1 Million Input-Token, 15 $ pro 1 Million Output-Token
Was macht Claude 4.6 Sonnet besonders?
Claude 4.6 Sonnet setzt die Tradition der Sonnet-Reihe fort, die beste Balance aus Leistung und Kosten zu bieten. Mit 79,6 % im SWE-bench kommt es nah an die Opus-Variante heran, kostet aber nur ein Fünftel. Für die meisten professionellen Anwendungen ist es die empfohlene Wahl.
Verfügbarkeit: Claude 4.6 Sonnet ist verfügbar über die Claude API, Claude.ai Web-Interface, Claude iOS und Android Apps.
Claude 4.5 Opus
Veröffentlicht: November 2025Claude 4.5 Opus ist das Flaggschiff der 4.5-Generation und bietet die höchste Intelligenz dieser Modellfamilie. Mit Extended Thinking kann es bei besonders anspruchsvollen Aufgaben zusätzliche Denkzeit nutzen.
Hauptmerkmale
- Höchste Intelligenz der 4.5-Generation: Übertrifft Claude 4.5 Sonnet bei komplexen Reasoning-Aufgaben
- Extended Thinking: Erweiterte Denkzeit für besonders anspruchsvolle Probleme
- 200.000 Token Kontextfenster
- Multimodale Fähigkeiten: Verarbeitet Text, Bilder und Dokumente
- API-Preise: 5 $ pro 1 Million Input-Token, 25 $ pro 1 Million Output-Token
Was macht Claude 4.5 Opus besonders?
Claude 4.5 Opus verbindet die hervorragenden Coding-Fähigkeiten der 4.5-Generation mit der tieferen Reasoning-Kapazität eines Opus-Modells. Besonders bei komplexen wissenschaftlichen Fragestellungen, mathematischen Beweisen und Architekturdiskussionen zeigt es seine Stärken. Das Extended Thinking erlaubt es dem Modell, bei schwierigen Problemen schrittweise und transparent zu denken.
Verfügbarkeit: Claude 4.5 Opus ist verfügbar über die Claude API, Claude.ai Web-Interface, Claude iOS und Android Apps.
Claude 4.5 Haiku
Veröffentlicht: 15. Oktober 2025Claude 4.5 Haiku ist das neueste Haiku-Modell und markiert einen bedeutenden Fortschritt in der kostengünstigen, schnellen KI-Kategorie. Es ist das erste Haiku-Modell der Version 4.5 und bietet eine beeindruckende Kombination aus Geschwindigkeit, niedrigen Kosten und überraschend hoher Leistung.
Hauptmerkmale
- Deutlich verbesserte Leistung: Übertrifft Claude 3.5 Haiku in allen Benchmarks bei ähnlichen Kosten
- Schnellste Antwortzeiten: Optimiert für Hochdurchsatz-Anwendungen mit minimaler Latenz
- Erweiterte Coding-Fähigkeiten: Starke Performance bei Programmieraufgaben für ein Haiku-Modell
- 200.000 Token Kontextfenster mit bis zu 64.000 Output-Token
- Multimodale Fähigkeiten: Verarbeitet Text, Bilder und Dokumente
- Knowledge Cutoff: Januar 2025, Training Data bis Juli 2025
- API-Preise: 1 $ pro 1 Million Input-Token, 5 $ pro 1 Million Output-Token
- Modell-String: claude-haiku-4-5-20251001
- Safety Level: ASL-2 (AI Safety Level 2 Standard)
Was macht Claude 4.5 Haiku besonders?
Claude 4.5 Haiku füllt eine wichtige Lücke im Anthropic-Portfolio: Es bietet deutlich höhere Leistung als sein Vorgänger Claude 3.5 Haiku, während es die Geschwindigkeit und niedrigen Kosten beibehält, die Haiku-Modelle auszeichnen. Das macht es zur perfekten Wahl für Anwendungen, die Tausende oder Millionen von API-Calls pro Tag erfordern.
Besonders beeindruckend ist die Coding-Performance: Während frühere Haiku-Modelle hauptsächlich für einfache Text-Aufgaben gedacht waren, kann Claude 4.5 Haiku auch bei mittleren bis komplexen Programmieraufgaben überraschend gute Ergebnisse liefern, bei einem Bruchteil der Kosten der Sonnet- oder Opus-Modelle.
Ideale Anwendungsfälle
- Chatbots und Kundenservice: Schnelle, präzise Antworten bei niedrigen Kosten
- Content-Moderation: Hochdurchsatz-Analyse von User-Generated Content
- Einfache Automatisierung: Code-Snippets, Formatierung, Datenextraktion
- Real-time Anwendungen: Wo minimale Latenz kritisch ist
- Batch-Processing: Verarbeitung großer Mengen von Dokumenten oder Texten
Verfügbarkeit: Claude 4.5 Haiku ist verfügbar über die Claude API, Claude.ai Web-Interface, Claude iOS und Android Apps, Amazon Bedrock und Google Cloud Vertex AI.
Praxis-Empfehlung: Für die meisten Produktionsumgebungen empfehle ich einen hybriden Ansatz: Claude 4.5 Haiku für schnelle, einfache Anfragen (z. B. FAQ-Beantwortung, Kategorisierung) und Claude 4.5 Sonnet für komplexe Aufgaben (z. B. Code-Reviews, tiefgehende Analysen). Dies optimiert sowohl Kosten als auch Performance.
Claude 4.5 Sonnet
Veröffentlicht: 29. September 2025Claude 4.5 Sonnet war bei seinem Release das fortschrittlichste Modell von Anthropic und kombinierte weltklasse Coding-Performance mit dem attraktiven Preis der Sonnet-Serie. Es stellte einen bedeutenden Durchbruch dar: Zum ersten Mal übertraf ein Sonnet-Modell die Opus-Varianten bei den wichtigsten Benchmarks. Inzwischen wurde es von den Claude 4.6-Modellen übertroffen.
Hauptmerkmale
- Führende Coding-Performance: Spitzenwert im SWE-bench Verified Benchmark, übertrifft selbst Claude 4.1 Opus
- Beeindruckende Fokus-Fähigkeit: Kann über 30+ Stunden bei komplexen, mehrstufigen Aufgaben fokussiert bleiben
- OSWorld-Führung: 61,4 % Performance im OSWorld-Benchmark (vs. 42,2 % bei Claude 4 Sonnet vier Monate zuvor)
- 200.000 Token Kontextfenster mit bis zu 64.000 Output-Token
- Multimodale Fähigkeiten: Verarbeitet Text, Bilder und Dokumente
- Knowledge Cutoff: Januar 2025, Training Data bis Juli 2025
- API-Preise: 3 $ pro 1 Million Input-Token, 15 $ pro 1 Million Output-Token
- Modell-String: claude-sonnet-4-5-20250929
- Safety Level: ASL-3 (AI Safety Level 3 Standard)
Was macht Claude 4.5 Sonnet besonders?
Claude 4.5 Sonnet markiert einen Paradigmenwechsel in Anthropics Modell-Strategie. Während früher die Opus-Modelle die absolute Spitzenleistung boten, hat Anthropic es geschafft, mit Claude 4.5 Sonnet ein Modell zu entwickeln, das bei einem Fünftel der Kosten die Opus-Varianten in den meisten Bereichen übertrifft.
Die bemerkenswerteste Fähigkeit ist die „Extended Focus“: Claude 4.5 Sonnet kann bei komplexen Entwicklungsaufgaben über 30 Stunden hinweg fokussiert arbeiten, ohne an Qualität oder Kohärenz zu verlieren. Dies macht es ideal für große Refactoring-Projekte, komplexe Systemarchitekturen und mehrstufige Debugging-Sessions.
Verfügbarkeit: Claude 4.5 Sonnet ist verfügbar über die Claude API, Claude.ai Web-Interface, Claude iOS und Android Apps, Amazon Bedrock und Google Cloud Vertex AI.
Technische Innovation: Das Modell nutzt Anthropics neueste Fortschritte in Constitutional AI und wurde speziell darauf optimiert, lange Aufgaben ohne Qualitätsverlust zu bewältigen - eine Schwäche, die viele andere Modelle zeigen, wenn Sessions länger als 1-2 Stunden dauern.
Claude 4.1 Opus
Veröffentlicht: August 2025Claude 4.1 Opus war das fortschrittlichste Opus-Modell seiner Generation und baut auf der Claude 4-Familie auf, die einen Quantensprung in der KI-Entwicklung darstellte. Diese Hybrid-Reasoning-Modelle können zwischen zwei Modi wechseln: blitzschnelle Antworten für einfache Fragen und ausführliches „Nachdenken“ für komplexe Probleme. Inzwischen wurde es von Claude 4.5 Opus und Claude 4.6 Opus abgelöst.
Hauptmerkmale
- Verbesserte Reasoning-Fähigkeiten gegenüber Claude 4 Opus
- Starker Coding-Assistent mit 74,5 % Erfolgsquote im SWE-bench Verified
- Erweiterte Hybrid-Reasoning-Funktionen mit noch tieferem „Nachdenken“
- Deutlich reduzierte Halluzinationsrate (unter 2 % in Benchmarks)
- API-Preise: 15 $ pro 1 Million Input-Token, 75 $ pro 1 Million Output-Token
- 200.000 Token Kontextfenster
- Verbesserte multimodale Fähigkeiten, besonders bei technischen Diagrammen
Claude 4 Opus
Veröffentlicht: Mai 2025Claude 4 Opus war das ursprüngliche Flaggschiff-Modell der Claude 4-Familie, die die Hybrid-Reasoning-Technologie einführte.
Hauptmerkmale
- Vorheriger bester Coding-Assistent mit 72,5 % Erfolgsquote im SWE-bench (jetzt übertroffen von 4.1 Opus)
- Hybrid-Reasoning: Nutzer können wählen zwischen schnellen und durchdachten Antworten
- Hervorragend für komplexe wissenschaftliche, mathematische und Programmieraufgaben
- API-Preise: 15 $ pro 1 Million Input-Token, 75 $ pro 1 Million Output-Token
- 200.000 Token Kontextfenster
- Multimodale Fähigkeiten (Text, Bilder, Dokumente)
Der Clou dabei: Das Besondere an Claude 4 ist die Fähigkeit zur „erweiterten Denkzeit“. Nutzer können explizit wählen, ob sie eine schnelle Antwort oder eine durchdachte, schrittweise Analyse wollen, ähnlich wie Menschen unterschiedlich viel Zeit zum Nachdenken verwenden.
Claude 4 Sonnet
Veröffentlicht: Mai 2025Claude 4 Sonnet ist die ausgewogene Version der Claude 4-Familie und bietet die beste Balance zwischen Leistung und Kosten für die meisten Anwendungen.
Hauptmerkmale
- Ebenfalls mit Hybrid-Reasoning-Fähigkeiten ausgestattet
- Besseres Preis-Leistungs-Verhältnis als Opus
- API-Preise: 3 $ pro 1 Million Input-Token, 15 $ pro 1 Million Output-Token
- Ideal für die meisten professionellen Anwendungen
- Gleiche technische Grundausstattung wie Opus
- 200.000 Token Kontextfenster
- Multimodale Fähigkeiten (Text, Bilder, Dokumente)
Claude 3.7 Sonnet
Veröffentlicht: 24. Februar 2025Claude 3.7 Sonnet war das erste Modell, das Anthropics neue Hybrid-Reasoning-Technologie einführte. Es ermöglicht Nutzern, zwischen schnellen Antworten und einem „erweiterten Denkmodus“ zu wechseln.
Hauptmerkmale
- Erster Claude mit steuerbarer Denkzeit
- Toggle zwischen „Schnell“- und „Denk“-Modus
- Verbesserte Leistung bei komplexen Reasoning-Aufgaben
- 200.000 Token Kontextfenster
- Multimodale Eingabe (Text und Bilder)
- Testmodell für die spätere Claude 4-Entwicklung
Claude 3.7 Sonnet diente als Brücke zwischen der klassischen Claude 3-Serie und der neuen Claude 4-Familie und bewies, dass kontrollierbare KI-Reasoning möglich ist.
Claude 3.5 Haiku
Veröffentlicht: 4. November 2024Claude 3.5 Haiku ist das schnellste und kostengünstigste Modell der Claude 3.5-Serie, das die Grundlagen der Claude 3-Familie erheblich verbesserte.
Hauptmerkmale
- Schnellstes und kostengünstigstes Modell der Serie
- Optimiert für hohe Durchsatzraten
- Trotz Geschwindigkeit beeindruckende Qualität
- Perfekt für Chatbots und einfache Automatisierung
- Multimodale Fähigkeiten bei geringen Kosten
- 200.000 Token Kontextfenster
- API-Preise: 0,80 $ pro 1 Million Input-Token, 4 $ pro 1 Million Output-Token
Claude 3.5 Sonnet
Veröffentlicht: 21. Juni 2024Claude 3.5 Sonnet war das erste Modell der verbesserten 3.5-Serie und bot bessere Leistung bei ähnlichen Kosten wie Claude 3.
Hauptmerkmale
- Übertrifft Claude 3 Opus in vielen Benchmarks
- Deutlich günstiger als Opus bei vergleichbarer Leistung
- Verbesserte Coding-Fähigkeiten und visuelles Verständnis
- Bessere Workflow-Integration und Tool-Nutzung
- 200.000 Token Kontextfenster
- Ideal für produktive Anwendungen
- API-Preise: 3 $ pro 1 Million Input-Token, 15 $ pro 1 Million Output-Token
Claude 3 Opus
Veröffentlicht: März 2024Claude 3 Opus war das leistungsstärkste Modell der Claude 3-Familie, die einen Wendepunkt markierte: erstmals konnten Claude-Modelle sowohl Text als auch Bilder verarbeiten.
Hauptmerkmale
- Das leistungsstärkste Modell der Serie
- Erste Claude-Version mit echter Multimodalität
- Hervorragend für komplexe Analyse- und Reasoning-Aufgaben
- 200.000 Token Kontextfenster
- Wurde am 30. Juni 2025 eingestellt (Retirement am 5. Januar 2026)
Claude 3 und neuere Versionen gehören zu den besten KI-Tools für die Bildanalyse und eignen sich hervorragend für KI-Bilderkennung und die Analyse technischer Dokumentation.
Claude 3 Sonnet
Veröffentlicht: März 2024Claude 3 Sonnet war das ausgewogene Modell der Claude 3-Familie, die an japanische Poesieformen angelehnte Namenskonvention einführte.
Hauptmerkmale
- Ausgewogenes Modell zwischen Leistung und Kosten
- Gute Allround-Fähigkeiten für die meisten Anwendungen
- Multimodale Fähigkeiten (Text und Bilder)
- 200.000 Token Kontextfenster
- Wurde am 21. Juli 2025 durch Claude 3.5 Sonnet ersetzt
Claude 3 Haiku
Veröffentlicht: März 2024Claude 3 Haiku war das schnellste und günstigste Modell der Claude 3-Familie.
Hauptmerkmale
- Schnellstes und günstigstes Modell der Claude 3-Serie
- Erste multimodale Claude-Version für Hochdurchsatz-Anwendungen
- Im April 2026 eingestellt
- 200.000 Token Kontextfenster
- Multimodale Fähigkeiten (Text und Bilder)
- API-Preise: 0,25 $ pro 1 Million Input-Token, 1,25 $ pro 1 Million Output-Token
Claude 2.1
Veröffentlicht: November 2023Claude 2.1 war die weiter verbesserte Version von Claude 2, dem ersten öffentlich verfügbaren Claude.
Hauptmerkmale
- Reduzierte Halluzinationen gegenüber Claude 2.0
- Bessere Anweisungsbefolgung
- 100.000 Token Kontextfenster
- Verbesserte Sicherheit durch Constitutional AI
- Nicht mehr verfügbar
Claude 2.0
Veröffentlicht: Juli 2023Claude 2.0 war der erste öffentlich verfügbare Claude und brachte erhebliche Verbesserungen gegenüber der ersten Generation.
Hauptmerkmale
- Erstes öffentlich verfügbares Claude-Modell
- 100.000 Token Kontextfenster (damals revolutionär)
- Verbesserte Sicherheit durch Constitutional AI
- Bessere Coding-Fähigkeiten als Claude 1
- Inzwischen eingestellt
Claude-Instant 1.2
Veröffentlicht: August 2023Claude-Instant 1.2 war die finale Version der Instant-Reihe, die schnellere und günstigere Alternativen zu den Hauptmodellen bot.
Hauptmerkmale
- 100.000 Token Kontextfenster (erweitert von 9.000)
- Schnellere, günstigere Version
- Finale Version der Instant-Reihe
- Inzwischen eingestellt
Claude 1.3
Veröffentlicht: Juni 2023Claude 1.3 war die finale Version der ersten Claude-Generation, die den Grundstein für Anthropics Ansatz zur KI-Sicherheit legte.
Hauptmerkmale
- Finale Claude 1-Version
- 9.000 Token Kontextfenster
- Constitutional AI-Training
- Fokus auf Sicherheit und Hilfsbereitschaft
- Inzwischen eingestellt
Claude 1.2
Veröffentlicht: Mai 2023Claude 1.2 war eine Zwischenversion der ersten Claude-Generation.
Hauptmerkmale
- Verbesserte Constitutional AI
- 9.000 Token Kontextfenster
- Fokus auf Sicherheit
- Inzwischen eingestellt
Claude-Instant 1.1
Veröffentlicht: Mai 2023Claude-Instant 1.1 war die verbesserte Version der schnellen Instant-Serie.
Hauptmerkmale
- Verbesserte Leistung vs. 1.0
- 9.000 Token Kontextfenster
- Schnellere, günstigere Version
- Inzwischen eingestellt
Claude-Instant 1.0
Veröffentlicht: März 2023Claude-Instant 1.0 war die erste schnelle, kostenoptimierte Version der Claude-Modelle.
Hauptmerkmale
- Schnellere, günstigere Version
- 9.000 Token Kontextfenster
- Constitutional AI
- Inzwischen eingestellt
Claude 1.0
Veröffentlicht: März 2023Claude 1.0 war das allererste Modell von Anthropic und legte den Grundstein für alle späteren Entwicklungen.
Hauptmerkmale
- Erstes Modell mit Constitutional AI-Training
- 9.000 Token Kontextfenster
- Fokus auf Sicherheit und Hilfsbereitschaft
- Grundlage für alle späteren Entwicklungen
- Inzwischen eingestellt






