Abrechnungsbeschreibung
QCode.cc Abrechnungsmethoden, Preisdatenquellen und Gebührenberechnungslogik verstehen
Auf dieser Seite
Dieses Dokument bietet eine detaillierte Einführung in die Abrechnungsmethoden und Preislogik von QCode.cc und hilft Ihnen zu verstehen, wie Kosten berechnet werden.
Abrechnungsgrundsätze¶
QCode.cc rechnet auf Basis des Tokenverbrauchs ab. Jedes Mal, wenn Sie ein KI-Modell aufrufen, setzen sich die Kosten aus zwei Teilen zusammen:
-
Input Tokens: Der Inhalt, den Sie an das Modell senden, einschließlich Prompts, Kontext, Dateiinhalte usw.
-
Output Tokens: Der Antwortinhalt, der vom Modell generiert wird.
Was ist ein Token? Ein Token ist die Grundeinheit von Text, die vom Modell verarbeitet wird. Im Englischen entspricht 1 Token ungefähr 4 Zeichen oder ¾ eines Wortes; im Chinesischen entspricht 1 Zeichen typischerweise 1–2 Tokens.
Kostenberechnungsformel:
Total Cost = Input Tokens × Input Unit Price + Output Tokens × Output Unit Price
Preisdatenquelle¶
Wie der Preis berechnet wird¶
QCode price = official API price × service rate
Der Service Rate ist die Gebühr für Routing und Relay-Dienst. Die Plattform legt ihn je Anbieter fest, daher kann er zwischen Anbietern variieren. Der endgültige Stückpreis jedes Modells und der aktuelle Rate werden in den Preislisten oben auf qcode.cc/models angezeigt – diese Seite ist auch die einzige Datenquelle, die für die Abrechnung verwendet wird.
Darüber hinaus veröffentlichen Anbieter Listenpreise für API-Aufrufe, haben aber ihre vollständigen internen Token-Zählregeln nicht offengelegt (zum Beispiel: ob System-Prompts gezählt werden, wie Tool-Use-Tokens gezählt werden, wie Cache-Treffer bepreist werden). Deshalb können Schätzung und tatsächliche Rechnung dennoch leicht voneinander abweichen.
qcode.cc/models Preistabelle¶
Um Transparenz und Fairness bei der Abrechnung sicherzustellen, verwendet QCode.cc die auf der offiziellen qcode.cc/models-Seite gepflegte Modellpreistabelle als Abrechnungsmaßstab:
Datenquellen-Adresse: qcode.cc/models
Warum qcode.cc/models?
-
Echtzeit-Synchronisation: Die Preise auf der Models-Seite werden zeitnah aktualisiert, wenn Anbieter Preise anpassen.
-
Einheitliche Datenquelle: Verwendet dieselben Preisdaten wie Konsole-Abrechnung und Plan-Kontingente.
-
Umfassende Abdeckung: Deckt alle Modelle großer Anbieter wie Anthropic, OpenAI und Google ab.
-
Offen und transparent: Alle Preise sind öffentlich zugänglich und für jeden einsehbar und überprüfbar.
-
Zeitnahe Updates: Wenn Modellanbieter Preise anpassen, werden die Preisdaten zeitnah aktualisiert.
Unterstützte Modellfamilien¶
QCode unterstützt sieben Modellfamilien: Claude, GPT / Codex, Gemini, GLM, Kimi, DeepSeek und Qwen. Es gibt kein grok.
Die vier chinesischen Familien (GLM / Kimi / DeepSeek / Qwen) teilen sich denselben cr_-Key und dieselben Endpunkte wie die ersten drei. Für die derzeit angebotenen IDs (wie glm-5.2, kimi-k3, deepseek-v4-pro, qwen3.7-max) verlassen Sie sich auf qcode.cc/models; wie Sie Protokoll und Modellname eintragen, erfahren Sie unter Chinesische Modelle.
Haupt-Modellpreisreferenz¶
Preise für häufig genutzte Modelle (Einheit: USD / Million Tokens):
Aktuelle Modellpreise¶
Für aktuelle Preise je Modell (Input / Output / Cache) verweisen Sie stets auf qcode.cc/models – es ist die einzige Abrechnungsdatenquelle; diese Seite pflegt keine eigene Kopie der Zahlen mehr, um Abweichungen von der tatsächlichen Abrechnung zu vermeiden.
Grobe Größenordnung (Haiku 4.5 Input-Preis = 1×):
- Claude-Familie: Haiku 4.5 (1×) < Sonnet 5 (≈2×) < Sonnet 4.6 (≈3×) < Opus 5 / 4.8 (≈5×) < Fable 5 (≈10×)
- GPT-Familie: siehe Models-Seite für gpt-6-Familie (sol / luna / astra) sowie gpt-5.6-sol / gpt-5.6-terra-Raten
Sie können verfügbare Modelle jederzeit mit einem authentifizierten GET
https://api.qcode.cc/v1/modelsauflisten.
Zum Cache-Preis¶
Einige Modelle (wie die Claude-Serie) unterstützen Prompt Caching, das wiederholte Kontextinhalte cacht. Cache-bezogene Preise:
-
Cache-Schreibvorgang: Die Kosten für das erste Schreiben von Inhalten in den Cache, üblicherweise etwas höher als reguläre Input-Preise.
-
Cache-Lesevorgang: Die Kosten bei einem Cache-Treffer, üblicherweise rund 10 % der regulären Input-Preise.
Der Caching-Mechanismus kann die Nutzungskosten in Szenarien mit wiederholtem Kontext erheblich senken.
Abrechnungsbeispiele¶
Angenommen, Sie nutzen claude-sonnet-5 für eine Code-Q&A-Sitzung:
| Posten | Menge | Einzelpreis | Kosten |
|---|---|---|---|
| Input-Tokens | 5,000 | $2.00 / Million | $0.010 |
| Output-Tokens | 2,000 | $10.00 / Million | $0.020 |
| Gesamt | $0.030 |
In der Praxis umfasst eine vollständige Interaktion mit Claude Code in der Regel mehrere API-Aufrufe (Code analysieren, Lösungen generieren, Operationen ausführen usw.). Die tatsächlichen Kosten liegen daher höher als bei einem einzelnen Aufruf.
Mechanismus für Preisaktualisierungen¶
-
QCode.cc gleicht die Preisdaten von qcode.cc/models regelmäßig ab.
-
Gibt ein Modellanbieter Preisanpassungen bekannt, aktualisiert qcode.cc/models die Preise zeitnah, und wir gleichen sie entsprechend ab.
-
Preisaktualisierungen wirken sich nicht auf bereits angefallene Kosten aus; sie betreffen nur die Nutzung nach der Aktualisierung.
So sehen Sie Ihre Nutzung ein¶
Dashboard (empfohlen)¶
Melden Sie sich in der QCode.cc Console an und öffnen Sie die Seite „Nutzungsstatistik“. Dort sehen Sie:
-
Details zu Modellaufrufen: Modell, Token-Anzahl und Kosten für jeden Aufruf.
-
Kostenübersicht: Tägliche und monatliche Kostenstatistiken.
-
Verbrauch im Plan: Aktuelle Kontingentnutzung Ihres Abos.
Anzeige in der CLI¶
Mit dem Befehl /cost in Claude Code sehen Sie schnell die Nutzungsübersicht der aktuellen Sitzung:
/cost
Tipp: Die von
/costangezeigten Kosten sind ein Näherungswert. Genaue Daten finden Sie im Dashboard.
FAQ¶
Entsprechen Ihre Preise den offiziellen Preisen?¶
Nicht ganz. QCode-Preis = offizieller API-Preis × Servicefaktor. Der Servicefaktor ist die Gebühr für Routing und Relay-Dienst, die die Plattform pro Anbieter festlegt. Den endgültigen Einzelpreis jedes Modells und den aktuellen Faktor finden Sie unter qcode.cc/models; diese Seite ist die maßgebliche Quelle für die Abrechnung.
Außerdem werden die internen Regeln der Anbieter zur Token-Zählung nicht vollständig offengelegt. Daher können die in der CLI integrierte Schätzung von /cost und die im Dashboard angezeigten tatsächlichen Kosten weiterhin geringfügig voneinander abweichen.
Wie oft werden die Preisdaten aktualisiert?¶
Wir gleichen regelmäßig mit der Datenquelle qcode.cc/models ab. Aktualisierungen sind in der Regel innerhalb weniger Tage abgeschlossen, nachdem ein Anbieter Preisanpassungen bekannt gegeben hat.
Wie kann ich die Preise selbst überprüfen?¶
Sie können die Preisdaten unter qcode.cc/models direkt einsehen:
-
Rufen Sie qcode.cc/models auf.
-
Suchen Sie nach dem Namen des Modells, das Sie verwenden (z. B.
claude-sonnet-5). -
Prüfen Sie den Input- und den Output-Preis.
-
Die Preise werden pro Million Tokens angegeben.
Warum eine öffentliche Preistabelle statt individueller Preise?¶
Eine offene, transparente und maßgebliche Quelle sorgt für Fairness. Die Preistabelle unter qcode.cc/models ist öffentlich zugänglich und kann von jedem eingesehen und überprüft werden. So lassen sich Preisstreitigkeiten vermeiden.
Enterprise-Kunden: Der QCode Enterprise-Team-Tarif unterstützt Firmenüberweisung und offizielle Umsatzsteuerrechnungen; zudem können wir einen förmlichen Dienstleistungsvertrag abschließen. Ab ¥320 pro Person und Monat – siehe den Enterprise-Leitfaden oder fragen Sie unter qcode.cc/enterprise nach.
Weitere Seiten¶
- Tarife & Preise — Aktuelle Tarife und Rabatte ansehen
- Modelle & Preise — Echtzeit-Preise und Faktoren aller unterstützten Modelle ansehen
- Chinesische Modelle — Pfade und IDs für GLM / Kimi / DeepSeek / Qwen
- FAQ — Rückerstattungen, Rechnungen, Kontingente und weitere Kontofragen