Leitfaden zur Modellauswahl

Lernen Sie die Eigenschaften und Einsatzszenarien verschiedener KI-Modelle kennen, um die beste Wahl zu treffen.

Aktualisiert 2026-10-01
Auf dieser Seite

Leitfaden zur Modellauswahl

Claude Code unterstützt mehrere KI-Modelle, die sich in Leistungsfähigkeit, Geschwindigkeit und Preis unterscheiden. Mit dem passenden Modell erzielen Sie die besten Ergebnisse und behalten zugleich die Kosten im Griff. Dieser Leitfaden hilft Ihnen, für jedes Szenario die optimale Wahl zu treffen.

💰 Diese Seite behandelt nur, wie Sie auswählen; die aktuellen Preise pro Token finden Sie immer unter qcode.cc/models. Alle Kosten unten sind als relative Verhältnisse angegeben.

Überblick über die Claude-Modellfamilie

Die derzeit über QCode.cc verfügbaren Claude-Modelle bilden eine Leistungsleiter:

Claude Fable 5 — Spitzenmodell der obersten Klasse

Fable 5 ist die derzeit leistungsfähigste Stufe und zugleich die teuerste (der Input-Preis liegt ungefähr beim 10-Fachen von Haiku):

  • Stärkstes Reasoning: entwickelt für die schwierigsten Probleme – systemübergreifende Architektur, knifflige Nebenläufigkeits-/Distributed-Bugs, einmalige kritische Entscheidungen
  • 1M Kontext / 128K Output: Verständnis ganzer Codebasen bei großen Projekten
  • Für wichtige Momente aufsparen: Für Routineaufgaben ist es überdimensioniert, und die Kosten rechnen sich nicht

Am besten geeignet für: kritische technische Entscheidungen, hartnäckige Bugs, die dem Debugging bisher standgehalten haben, einmalige Aufgaben, bei denen die Ausgabequalität am wichtigsten ist.

Claude Opus 5.5 / 5 / 4.8 — Flaggschiff-Arbeitspferd

Opus ist das bewährte Flaggschiff-Arbeitspferd:

  • Tiefes Reasoning: logisches Schließen über lange Ketten, gut geeignet für komplexen Architekturentwurf
  • Codequalität: Der generierte Code ist gründlicher und geht besser mit Randfällen um
  • 1M Kontext: stark im Verständnis großer Codebasen
  • Gleicher Preis, gleiches Fenster: Opus 5 und Opus 4.8 haben identische Preise sowie identische Kontext- und Output-Limits – wechseln Sie frei zwischen beiden
  • Opus 5.5 (claude-opus-5-5): die neueste Opus-Version, jetzt verfügbar; wählen Sie sie mit /model claude-opus-5-5 oder ANTHROPIC_MODEL=claude-opus-5-5 (Preise unter qcode.cc/models)

Am besten geeignet für: Architekturentwurf, umfangreiches Refactoring, Bewertung technischer Konzepte, komplexe Fehlersuche.

Claude Sonnet 5 / Sonnet 4.6 — Beste Balance

Sonnet ist das Alltagsmodell der meisten Entwickler und bietet die beste Balance zwischen Leistungsfähigkeit und Kosten:

  • Sonnet 5: die ausgewogene Stufe der neuen Generation, 1M Kontext / 128K Output, günstiger als Sonnet 4.6 ($2/$10 vs. $3/$15) bei doppeltem Output-Limit (128K vs. 64K) – die empfohlene Standardwahl für neue Projekte
  • Sonnet 4.6: ausgereift und stabil, 1M Kontext (optional zuschaltbar), für das alltägliche Coding völlig ausreichend
  • Hervorragendes Preis-Leistungs-Verhältnis: Der Input-Preis liegt bei etwa 60 % von Opus, bei nahezu vergleichbarer Ausgabequalität
  • Schneller: flotter als Opus, gut geeignet für häufiges Hin und Her

Am besten geeignet für: alltägliches Coding, Bugfixes, Code-Review, Dokumentation, Schreiben von Tests.

Claude Haiku 4.5 — Leicht und schnell

Haiku ist die kleinste und schnellste Stufe und zugleich die günstigste:

  • Höchste Geschwindigkeit, niedrigster Preis (der Input-Preis liegt bei etwa 1/3 von Sonnet)
  • Solide Grundlagen: bei einfachen Aufgaben voll leistungsfähig, bei komplexem Reasoning eingeschränkt
  • 200K Kontext

Am besten geeignet für: einfache Fragen und Antworten, Code-Formatierung, Generierung von Boilerplate, schnelle Übersetzungen.

Detaillierter Modellvergleich

Dimension Fable 5 Opus 5 / 4.8 Sonnet 5 Sonnet 4.6 Haiku 4.5
Kontextfenster 1M 1M 1M 1M (optional) 200K
Relative Kosten (Input) ≈10× ≈5× ≈3× ≈3× 1×
Reasoning Branchenbester Exzellent Stark Stark Grundlegend
Codequalität Branchenbeste Exzellent Hoch Hoch Mittel
Antwortgeschwindigkeit Langsamer Langsamer Mittel Mittel Schnell

Die relativen Kosten nehmen den Input-Preis von Haiku 4.5 als 1×; genaue Preise pro Token und für den Cache finden Sie unter qcode.cc/models.

Relative Kosten für dieselbe Aufgabe

Angenommen, Sie erledigen eine mittelkomplexe Coding-Aufgabe (15K Input-Tokens, 5K Output-Tokens), wobei die Kosten von Haiku die Basis bilden:

Modell Relative Kosten Faustregel
Fable 5 ≈10× Für kritische Aufgaben reservieren
Opus 5 / 4.8 ≈5× Bei komplexer Arbeit jeden Cent wert
Sonnet 5 ≈2× Alltagsmodell, bestes Preis-Leistungs-Verhältnis
Sonnet 4.6 ≈3× Weiterhin verfügbar; 64K Output-Limit
Haiku 4.5 1× Ideal für Fleißarbeit

Der Leistungsunterschied ist ebenso groß – wer eine komplexe Aufgabe mit einem günstigen Modell bearbeitet, muss sie womöglich mehrfach wiederholen und gibt am Ende unter Umständen insgesamt mehr aus.

Szenariobasierte Auswahlhilfe

Tägliche Programmierung → Sonnet 5 / Sonnet 4.6

Für Funktionen, Komponenten, APIs und ähnliches im Tagesgeschäft reicht Sonnet völlig aus:

/model claude-sonnet-5

> "Add a deleteUser method to @src/services/user-service.ts"
> "Create a Pagination component with previous/next buttons and jump-to-page support"
> "Add pagination parameter support to @src/app/api/orders/route.ts"

Architekturdesign / Große Refactorings → Opus 5

Wenn es um Systemdesign und globale Entscheidungen geht, ist Opus' tiefgründiges Schlussfolgern den Preis wert:

/model opus

> "Analyze the overall architecture under @src/. I plan to split this monolith into microservices.
Evaluate which modules are good candidates for extraction and propose a split plan."

Kritische Entscheidungen / Hartnäckige Bugs → Fable 5

Für Bugs, denen Sie seit Ewigkeiten ohne Anhaltspunkt hinterherjagen, oder weitreichende einmalige technische Entscheidungen lohnt sich die Top-Stufe:

/model claude-fable-5

> "I've spent three days on this intermittent data inconsistency issue. Symptoms, logs, and repro steps below...
Systematically analyze all possible root causes and propose a verification plan."

Codeformatierung / Einfache Q&A → Haiku 4.5

Für mechanische Arbeit ohne tiefes Denken ist Haiku die wirtschaftlichste Wahl:

/model haiku

> "Add JSDoc comments to all interfaces in @src/types/index.ts"
> "What does this ESLint error mean: no-unused-vars"

Große PR-Reviews → Opus 5

Bei Reviews umfangreicher Änderungen über viele Dateien hinweg erkennt Opus tiefergehende Probleme.

Bug-Fixes → Sonnet 5 / 4.6

Sonnet erledigt die meisten Bug-Fixes problemlos; für besonders komplexe Bugs mit Nebenläufigkeit oder verteilten Systemen wechseln Sie auf Opus oder Fable.

Schnelle Referenz nach Szenario

Aufgabentyp Empfohlenes Modell Warum
Funktion/Komponente schreiben Sonnet 5 / 4.6 Bestes Preis-Leistungs-Verhältnis
Architekturdesign Opus Benötigt tiefgründiges Schlussfolgern
Refactoring (umfangreich) Opus Benötigt Verständnis der gesamten Codebasis
Bug-Fixes Sonnet Die meisten Bugs brauchen kein Opus
Hartnäckige Bugs (lange ungelöst) Fable 5 Schlussfolgerungsleistung auf höchstem Niveau
Einmalige kritische Entscheidungen Fable 5 / Opus Entscheidungsqualität hat Vorrang
Tests schreiben Sonnet Testlogik ist relativ überschaubar
Code-Review Sonnet/Opus Sonnet für einfache PRs, Opus für umfangreiche
Codeformatierung Haiku Mechanische Arbeit
Kommentare/Doku hinzufügen Haiku/Sonnet Haiku für einfache Kommentare, Sonnet für komplexe Doku
Einfache Q&A / Übersetzung Haiku In ein bis zwei Sätzen beantwortbar

Modelle wechseln

Methode 1: Der /model-Befehl (empfohlen)

Wechseln Sie jederzeit in Claude Code; die Änderung wirkt sofort:

/model                    # Show the current model and available options
/model sonnet             # Switch to Sonnet
/model opus               # Switch to Opus
/model haiku              # Switch to Haiku
/model claude-sonnet-5    # Switch by full model name
/model claude-fable-5

Methode 2: Umgebungsvariable

Legen Sie ein Standardmodell in Ihrem Shell-Profil (z. B. ~/.bashrc oder ~/.zshrc) fest:

export ANTHROPIC_MODEL=claude-sonnet-5

# Or specify it one-off at launch
ANTHROPIC_MODEL=claude-opus-5-5 claude

Methode 3: Konfiguration in CLAUDE.md

Geben Sie Claude Hinweise zur Modellauswahl in der CLAUDE.md Ihres Projekts (Hinweis: Dies sind Vorschläge, keine harte Konfiguration):

## Model Usage Suggestions

- Use Sonnet for everyday development
- Switch to Opus to evaluate the design before architecture changes
- Use Haiku for bulk comment additions to save cost

Methode 4: Startparameter

claude --model claude-fable-5
claude --model claude-sonnet-5
claude --model claude-haiku-4-5

GPT- und Codex-Modelle (über QCode.cc)

Über den Relay-Dienst von QCode.cc gewährt derselbe API-Key auch Zugriff auf Modelle der GPT-Reihe.

Verfügbare Modelle

Modell Kontext Empfohlen für
gpt-6-sol ⭐ 1,05M Flaggschiff, Standardempfehlung für allgemeine / komplexe Aufgaben
gpt-6.1-sol 1,05M GPT-6 Sol-Update veröffentlicht am 29.09.2026: gleicher Preis, niedrigerer Preis für Cache-Eingaben; kein none / minimal Reasoning-Aufwand
gpt-6-luna siehe qcode.cc/models Schnell, geringe Kosten
gpt-6-astra siehe qcode.cc/models Stärkste Kategorie, Premiumpreis
gpt-5.6-terra 272K GPT-5.6-Flaggschiff, Coding / komplexe Aufgaben
gpt-5.6-sol 272K GPT-5.6-Flaggschiff-Serienvariante

Preise finden Sie unter qcode.cc/models; die aktuelle Modellliste abrufen Sie über einen authentifizierten GET auf https://api.qcode.cc/v1/models.

Highlights der GPT-Reihe

  • gpt-6-sol ist das aktuelle Flaggschiff und die Standardempfehlung mit 1,05M Kontext
  • gpt-6-luna ist schnell und kostengünstig – wirtschaftlich für Massenverarbeitung oder einfache Aufgaben
  • gpt-6-astra ist die stärkste Kategorie zu einem Premiumpreis
  • gpt-5.6-terra bleibt ein leistungsstarkes Arbeitspferd für Coding- und Codex-CLI-Szenarien
  • gpt-5.6-sol ist eine Variante der GPT-5.6-Reihe auf gleicher Ebene mit vergleichbaren Fähigkeiten

Wann Nicht-Claude-Modelle in Betracht ziehen

In den meisten Fällen sind Claude-Modelle die beste Wahl für Claude Code (native Integration). Die GPT-Reihe lohnt sich, wenn:

  • Sie Vergleichstests durchführen möchten: Lassen Sie dieselbe Aufgabe über verschiedene Modelle laufen und prüfen Sie, welche bessere Ergebnisse liefert
  • Codex-Workflows: Codex-CLI-Nutzer verwenden natürlicherweise die GPT-Reihe
  • Budgetüberlegungen: Leichte GPT-Modelle sind bei einfachen Aufgaben günstiger
# GPT models are not on the Anthropic leg: /model gpt-* is rejected inside Claude Code
# To use GPT, go through Codex CLI (the OpenAI Responses / Chat legs)
codex --model gpt-6-sol "Refactor this module"

Hinweis: Nicht-Claude-Modelle unterstützen möglicherweise bestimmte Funktionen in Claude Code nicht (wie Teile von Extended Thinking). Wir empfehlen Claude-Modelle als erste Wahl, andere Modelle als Ergänzung.

Kosten-Nutzen-Analyse

Eine Mischstrategie

Die kosteneffizienteste Strategie lautet: „Sonnet für den Großteil der Arbeit, Opus für den Feinschliff, Fable für die harten Nüsse, Haiku für Routineaufgaben“:

Task allocation (reference):
├── Sonnet 5 / 4.6 (~70%) — everyday development, bug fixes, writing tests, reviews
├── Opus 5 / 4.8   (~13%) — architecture decisions, complex problems, large refactors
├── Fable 5        (~2%)  — critical decisions, long-unresolved stubborn bugs
└── Haiku 4.5      (~15%) — formatting, simple Q&A, bulk operations

Verglichen mit einem durchgehenden Flaggschiff-Modell kostet die Mischstrategie etwa so viel wie reines Sonnet – bei gleichzeitig verfügbarer Spitzenintelligenz genau dann, wenn sie wirklich gebraucht wird.

Wann sich ein Upgrade lohnt

Der Wechsel zu Opus oder sogar Fable zahlt sich aus, wenn eine Aufgabe eines der folgenden Kriterien erfüllt:

  1. Große Auswirkung: Die Änderung betrifft mehrere Module, Systeme oder Teams
  2. Einmalige Entscheidungen: Architekturwahl, Tech-Stack-Migration und andere Entscheidungen, die nur schwer rückgängig zu machen sind
  3. Hoher Debugging-Aufwand: Der Bug widersteht seit Langem der Untersuchung und benötigt tiefere Analyse
  4. Codequalität ist kritisch: Der Code wird an vielen Stellen aufgerufen und muss robust sein

Umgekehrt genügen für interne Tools, Stiländerungen oder das Hinzufügen von Kommentaren Sonnet oder sogar Haiku.

Praktische Tipps

Modelle mitten in der Konversation wechseln

Sie können das Modell mitten in einer Konversation wechseln: Planen Sie zunächst mit Opus/Fable und wechseln Sie dann zu Sonnet für die Ausführung – Spitzenintelligenz für die entscheidenden Weichenstellungen, Kostenkontrolle während der Umsetzung.

/model opus
> "Analyze the existing code architecture and draft an implementation plan for the permissions system"

/model claude-sonnet-5
> "Following the plan above, start on step one: create the permission model"

Modellausgaben mit /cost vergleichen

Prüfen Sie nach Abschluss einer Aufgabe mit /cost, was sie gekostet hat. Beim nächsten Mal probieren Sie für eine ähnliche Aufgabe ein anderes Modell und vergleichen Sie Ergebnisse und Kosten. Nach einigen Vergleichen entwickeln Sie ein Gespür dafür, welches Modell zu welcher Art von Aufgabe passt.

Modellfähigkeiten entwickeln sich weiter

Die Fähigkeitsbeschreibungen auf dieser Seite spiegeln die relative Einordnung der aktuellen Versionen wider. Neue Modelleinführungen und Modellabkündigungen werden stets unter qcode.cc/models berücksichtigt. Im Zweifel entscheidet der Praxistest.

Verwandte Dokumente

QCode mit 9router verwenden
Fügen Sie QCode.cc als benutzerdefinierten Anbieter in 9router hinzu, einem lokalen Multi-Provider-Router für anbieterübergreifendes Fallback und einheitliche Verwaltung
gpt-image-2 Bildgenerierung und Bildbearbeitung
OpenAI-kompatible gpt-image-2 Text-zu-Bild- und Bildbearbeitungs-API: mit Umstellung von base_url sofort einsetzbar, Endpunkte in mehreren Regionen, einheitliche Abrechnung mit Ihrem QCode-Key
Bild-Input (Vision)
Bilder an Claude Code übergeben: Einfügen, Drag-and-Drop oder Dateipfad angeben, damit das Modell Screenshots, Mockups, Architekturdiagramme und Charts lesen kann. Unterstützt von QCode.cc-Vision-Modellen – ein API-Key funktioniert über alle Endpunkte hinweg.
🚀
Mit QCode starten — Claude Code & Codex
Ein Tarif für Claude Code und Codex, niedrige Latenz in Asien-Pazifik
Tarifpläne ansehen → Konto erstellen
Team ab 3 Personen?
Enterprise: eigene Domain + Sub-Key-Verwaltung + Ban-Schutz, ab ¥250 pro Person und Monat
Enterprise kennenlernen →