Leitfaden zur Modellauswahl
Lernen Sie die Eigenschaften und Einsatzszenarien verschiedener KI-Modelle kennen, um die beste Wahl zu treffen.
Auf dieser Seite
Leitfaden zur Modellauswahl¶
Claude Code unterstützt mehrere KI-Modelle, die sich in Leistungsfähigkeit, Geschwindigkeit und Preis unterscheiden. Mit dem passenden Modell erzielen Sie die besten Ergebnisse und behalten zugleich die Kosten im Griff. Dieser Leitfaden hilft Ihnen, für jedes Szenario die optimale Wahl zu treffen.
💰 Diese Seite behandelt nur, wie Sie auswählen; die aktuellen Preise pro Token finden Sie immer unter qcode.cc/models. Alle Kosten unten sind als relative Verhältnisse angegeben.
Überblick über die Claude-Modellfamilie¶
Die derzeit über QCode.cc verfügbaren Claude-Modelle bilden eine Leistungsleiter:
Claude Fable 5 — Spitzenmodell der obersten Klasse¶
Fable 5 ist die derzeit leistungsfähigste Stufe und zugleich die teuerste (der Input-Preis liegt ungefähr beim 10-Fachen von Haiku):
- Stärkstes Reasoning: entwickelt für die schwierigsten Probleme – systemübergreifende Architektur, knifflige Nebenläufigkeits-/Distributed-Bugs, einmalige kritische Entscheidungen
- 1M Kontext / 128K Output: Verständnis ganzer Codebasen bei großen Projekten
- Für wichtige Momente aufsparen: Für Routineaufgaben ist es überdimensioniert, und die Kosten rechnen sich nicht
Am besten geeignet für: kritische technische Entscheidungen, hartnäckige Bugs, die dem Debugging bisher standgehalten haben, einmalige Aufgaben, bei denen die Ausgabequalität am wichtigsten ist.
Claude Opus 5.5 / 5 / 4.8 — Flaggschiff-Arbeitspferd¶
Opus ist das bewährte Flaggschiff-Arbeitspferd:
- Tiefes Reasoning: logisches Schließen über lange Ketten, gut geeignet für komplexen Architekturentwurf
- Codequalität: Der generierte Code ist gründlicher und geht besser mit Randfällen um
- 1M Kontext: stark im Verständnis großer Codebasen
- Gleicher Preis, gleiches Fenster: Opus 5 und Opus 4.8 haben identische Preise sowie identische Kontext- und Output-Limits – wechseln Sie frei zwischen beiden
- Opus 5.5 (
claude-opus-5-5): die neueste Opus-Version, jetzt verfügbar; wählen Sie sie mit/model claude-opus-5-5oderANTHROPIC_MODEL=claude-opus-5-5(Preise unter qcode.cc/models)
Am besten geeignet für: Architekturentwurf, umfangreiches Refactoring, Bewertung technischer Konzepte, komplexe Fehlersuche.
Claude Sonnet 5 / Sonnet 4.6 — Beste Balance¶
Sonnet ist das Alltagsmodell der meisten Entwickler und bietet die beste Balance zwischen Leistungsfähigkeit und Kosten:
- Sonnet 5: die ausgewogene Stufe der neuen Generation, 1M Kontext / 128K Output, günstiger als Sonnet 4.6 ($2/$10 vs. $3/$15) bei doppeltem Output-Limit (128K vs. 64K) – die empfohlene Standardwahl für neue Projekte
- Sonnet 4.6: ausgereift und stabil, 1M Kontext (optional zuschaltbar), für das alltägliche Coding völlig ausreichend
- Hervorragendes Preis-Leistungs-Verhältnis: Der Input-Preis liegt bei etwa 60 % von Opus, bei nahezu vergleichbarer Ausgabequalität
- Schneller: flotter als Opus, gut geeignet für häufiges Hin und Her
Am besten geeignet für: alltägliches Coding, Bugfixes, Code-Review, Dokumentation, Schreiben von Tests.
Claude Haiku 4.5 — Leicht und schnell¶
Haiku ist die kleinste und schnellste Stufe und zugleich die günstigste:
- Höchste Geschwindigkeit, niedrigster Preis (der Input-Preis liegt bei etwa 1/3 von Sonnet)
- Solide Grundlagen: bei einfachen Aufgaben voll leistungsfähig, bei komplexem Reasoning eingeschränkt
- 200K Kontext
Am besten geeignet für: einfache Fragen und Antworten, Code-Formatierung, Generierung von Boilerplate, schnelle Übersetzungen.
Detaillierter Modellvergleich¶
| Dimension | Fable 5 | Opus 5 / 4.8 | Sonnet 5 | Sonnet 4.6 | Haiku 4.5 |
|---|---|---|---|---|---|
| Kontextfenster | 1M | 1M | 1M | 1M (optional) | 200K |
| Relative Kosten (Input) | ≈10× | ≈5× | ≈3× | ≈3× | 1× |
| Reasoning | Branchenbester | Exzellent | Stark | Stark | Grundlegend |
| Codequalität | Branchenbeste | Exzellent | Hoch | Hoch | Mittel |
| Antwortgeschwindigkeit | Langsamer | Langsamer | Mittel | Mittel | Schnell |
Die relativen Kosten nehmen den Input-Preis von Haiku 4.5 als 1×; genaue Preise pro Token und für den Cache finden Sie unter qcode.cc/models.
Relative Kosten für dieselbe Aufgabe¶
Angenommen, Sie erledigen eine mittelkomplexe Coding-Aufgabe (15K Input-Tokens, 5K Output-Tokens), wobei die Kosten von Haiku die Basis bilden:
| Modell | Relative Kosten | Faustregel |
|---|---|---|
| Fable 5 | ≈10× | Für kritische Aufgaben reservieren |
| Opus 5 / 4.8 | ≈5× | Bei komplexer Arbeit jeden Cent wert |
| Sonnet 5 | ≈2× | Alltagsmodell, bestes Preis-Leistungs-Verhältnis |
| Sonnet 4.6 | ≈3× | Weiterhin verfügbar; 64K Output-Limit |
| Haiku 4.5 | 1× | Ideal für Fleißarbeit |
Der Leistungsunterschied ist ebenso groß – wer eine komplexe Aufgabe mit einem günstigen Modell bearbeitet, muss sie womöglich mehrfach wiederholen und gibt am Ende unter Umständen insgesamt mehr aus.
Szenariobasierte Auswahlhilfe¶
Tägliche Programmierung → Sonnet 5 / Sonnet 4.6¶
Für Funktionen, Komponenten, APIs und ähnliches im Tagesgeschäft reicht Sonnet völlig aus:
/model claude-sonnet-5
> "Add a deleteUser method to @src/services/user-service.ts"
> "Create a Pagination component with previous/next buttons and jump-to-page support"
> "Add pagination parameter support to @src/app/api/orders/route.ts"
Architekturdesign / Große Refactorings → Opus 5¶
Wenn es um Systemdesign und globale Entscheidungen geht, ist Opus' tiefgründiges Schlussfolgern den Preis wert:
/model opus
> "Analyze the overall architecture under @src/. I plan to split this monolith into microservices.
Evaluate which modules are good candidates for extraction and propose a split plan."
Kritische Entscheidungen / Hartnäckige Bugs → Fable 5¶
Für Bugs, denen Sie seit Ewigkeiten ohne Anhaltspunkt hinterherjagen, oder weitreichende einmalige technische Entscheidungen lohnt sich die Top-Stufe:
/model claude-fable-5
> "I've spent three days on this intermittent data inconsistency issue. Symptoms, logs, and repro steps below...
Systematically analyze all possible root causes and propose a verification plan."
Codeformatierung / Einfache Q&A → Haiku 4.5¶
Für mechanische Arbeit ohne tiefes Denken ist Haiku die wirtschaftlichste Wahl:
/model haiku
> "Add JSDoc comments to all interfaces in @src/types/index.ts"
> "What does this ESLint error mean: no-unused-vars"
Große PR-Reviews → Opus 5¶
Bei Reviews umfangreicher Änderungen über viele Dateien hinweg erkennt Opus tiefergehende Probleme.
Bug-Fixes → Sonnet 5 / 4.6¶
Sonnet erledigt die meisten Bug-Fixes problemlos; für besonders komplexe Bugs mit Nebenläufigkeit oder verteilten Systemen wechseln Sie auf Opus oder Fable.
Schnelle Referenz nach Szenario¶
| Aufgabentyp | Empfohlenes Modell | Warum |
|---|---|---|
| Funktion/Komponente schreiben | Sonnet 5 / 4.6 | Bestes Preis-Leistungs-Verhältnis |
| Architekturdesign | Opus | Benötigt tiefgründiges Schlussfolgern |
| Refactoring (umfangreich) | Opus | Benötigt Verständnis der gesamten Codebasis |
| Bug-Fixes | Sonnet | Die meisten Bugs brauchen kein Opus |
| Hartnäckige Bugs (lange ungelöst) | Fable 5 | Schlussfolgerungsleistung auf höchstem Niveau |
| Einmalige kritische Entscheidungen | Fable 5 / Opus | Entscheidungsqualität hat Vorrang |
| Tests schreiben | Sonnet | Testlogik ist relativ überschaubar |
| Code-Review | Sonnet/Opus | Sonnet für einfache PRs, Opus für umfangreiche |
| Codeformatierung | Haiku | Mechanische Arbeit |
| Kommentare/Doku hinzufügen | Haiku/Sonnet | Haiku für einfache Kommentare, Sonnet für komplexe Doku |
| Einfache Q&A / Übersetzung | Haiku | In ein bis zwei Sätzen beantwortbar |
Modelle wechseln¶
Methode 1: Der /model-Befehl (empfohlen)¶
Wechseln Sie jederzeit in Claude Code; die Änderung wirkt sofort:
/model # Show the current model and available options
/model sonnet # Switch to Sonnet
/model opus # Switch to Opus
/model haiku # Switch to Haiku
/model claude-sonnet-5 # Switch by full model name
/model claude-fable-5
Methode 2: Umgebungsvariable¶
Legen Sie ein Standardmodell in Ihrem Shell-Profil (z. B. ~/.bashrc oder ~/.zshrc) fest:
export ANTHROPIC_MODEL=claude-sonnet-5
# Or specify it one-off at launch
ANTHROPIC_MODEL=claude-opus-5-5 claude
Methode 3: Konfiguration in CLAUDE.md¶
Geben Sie Claude Hinweise zur Modellauswahl in der CLAUDE.md Ihres Projekts (Hinweis: Dies sind Vorschläge, keine harte Konfiguration):
## Model Usage Suggestions
- Use Sonnet for everyday development
- Switch to Opus to evaluate the design before architecture changes
- Use Haiku for bulk comment additions to save cost
Methode 4: Startparameter¶
claude --model claude-fable-5
claude --model claude-sonnet-5
claude --model claude-haiku-4-5
GPT- und Codex-Modelle (über QCode.cc)¶
Über den Relay-Dienst von QCode.cc gewährt derselbe API-Key auch Zugriff auf Modelle der GPT-Reihe.
Verfügbare Modelle¶
| Modell | Kontext | Empfohlen für |
|---|---|---|
| gpt-6-sol ⭐ | 1,05M | Flaggschiff, Standardempfehlung für allgemeine / komplexe Aufgaben |
gpt-6.1-sol |
1,05M | GPT-6 Sol-Update veröffentlicht am 29.09.2026: gleicher Preis, niedrigerer Preis für Cache-Eingaben; kein none / minimal Reasoning-Aufwand |
gpt-6-luna |
siehe qcode.cc/models | Schnell, geringe Kosten |
gpt-6-astra |
siehe qcode.cc/models | Stärkste Kategorie, Premiumpreis |
gpt-5.6-terra |
272K | GPT-5.6-Flaggschiff, Coding / komplexe Aufgaben |
gpt-5.6-sol |
272K | GPT-5.6-Flaggschiff-Serienvariante |
Preise finden Sie unter qcode.cc/models; die aktuelle Modellliste abrufen Sie über einen authentifizierten GET auf
https://api.qcode.cc/v1/models.
Highlights der GPT-Reihe¶
- gpt-6-sol ist das aktuelle Flaggschiff und die Standardempfehlung mit 1,05M Kontext
- gpt-6-luna ist schnell und kostengünstig – wirtschaftlich für Massenverarbeitung oder einfache Aufgaben
- gpt-6-astra ist die stärkste Kategorie zu einem Premiumpreis
- gpt-5.6-terra bleibt ein leistungsstarkes Arbeitspferd für Coding- und Codex-CLI-Szenarien
- gpt-5.6-sol ist eine Variante der GPT-5.6-Reihe auf gleicher Ebene mit vergleichbaren Fähigkeiten
Wann Nicht-Claude-Modelle in Betracht ziehen¶
In den meisten Fällen sind Claude-Modelle die beste Wahl für Claude Code (native Integration). Die GPT-Reihe lohnt sich, wenn:
- Sie Vergleichstests durchführen möchten: Lassen Sie dieselbe Aufgabe über verschiedene Modelle laufen und prüfen Sie, welche bessere Ergebnisse liefert
- Codex-Workflows: Codex-CLI-Nutzer verwenden natürlicherweise die GPT-Reihe
- Budgetüberlegungen: Leichte GPT-Modelle sind bei einfachen Aufgaben günstiger
# GPT models are not on the Anthropic leg: /model gpt-* is rejected inside Claude Code
# To use GPT, go through Codex CLI (the OpenAI Responses / Chat legs)
codex --model gpt-6-sol "Refactor this module"
Hinweis: Nicht-Claude-Modelle unterstützen möglicherweise bestimmte Funktionen in Claude Code nicht (wie Teile von Extended Thinking). Wir empfehlen Claude-Modelle als erste Wahl, andere Modelle als Ergänzung.
Kosten-Nutzen-Analyse¶
Eine Mischstrategie¶
Die kosteneffizienteste Strategie lautet: „Sonnet für den Großteil der Arbeit, Opus für den Feinschliff, Fable für die harten Nüsse, Haiku für Routineaufgaben“:
Task allocation (reference):
├── Sonnet 5 / 4.6 (~70%) — everyday development, bug fixes, writing tests, reviews
├── Opus 5 / 4.8 (~13%) — architecture decisions, complex problems, large refactors
├── Fable 5 (~2%) — critical decisions, long-unresolved stubborn bugs
└── Haiku 4.5 (~15%) — formatting, simple Q&A, bulk operations
Verglichen mit einem durchgehenden Flaggschiff-Modell kostet die Mischstrategie etwa so viel wie reines Sonnet – bei gleichzeitig verfügbarer Spitzenintelligenz genau dann, wenn sie wirklich gebraucht wird.
Wann sich ein Upgrade lohnt¶
Der Wechsel zu Opus oder sogar Fable zahlt sich aus, wenn eine Aufgabe eines der folgenden Kriterien erfüllt:
- Große Auswirkung: Die Änderung betrifft mehrere Module, Systeme oder Teams
- Einmalige Entscheidungen: Architekturwahl, Tech-Stack-Migration und andere Entscheidungen, die nur schwer rückgängig zu machen sind
- Hoher Debugging-Aufwand: Der Bug widersteht seit Langem der Untersuchung und benötigt tiefere Analyse
- Codequalität ist kritisch: Der Code wird an vielen Stellen aufgerufen und muss robust sein
Umgekehrt genügen für interne Tools, Stiländerungen oder das Hinzufügen von Kommentaren Sonnet oder sogar Haiku.
Praktische Tipps¶
Modelle mitten in der Konversation wechseln¶
Sie können das Modell mitten in einer Konversation wechseln: Planen Sie zunächst mit Opus/Fable und wechseln Sie dann zu Sonnet für die Ausführung – Spitzenintelligenz für die entscheidenden Weichenstellungen, Kostenkontrolle während der Umsetzung.
/model opus
> "Analyze the existing code architecture and draft an implementation plan for the permissions system"
/model claude-sonnet-5
> "Following the plan above, start on step one: create the permission model"
Modellausgaben mit /cost vergleichen¶
Prüfen Sie nach Abschluss einer Aufgabe mit /cost, was sie gekostet hat. Beim nächsten Mal probieren Sie für eine ähnliche Aufgabe ein anderes Modell und vergleichen Sie Ergebnisse und Kosten. Nach einigen Vergleichen entwickeln Sie ein Gespür dafür, welches Modell zu welcher Art von Aufgabe passt.
Modellfähigkeiten entwickeln sich weiter¶
Die Fähigkeitsbeschreibungen auf dieser Seite spiegeln die relative Einordnung der aktuellen Versionen wider. Neue Modelleinführungen und Modellabkündigungen werden stets unter qcode.cc/models berücksichtigt. Im Zweifel entscheidet der Praxistest.