# 计费说明

本文档详细介绍 QCode.cc 的计费方式和定价逻辑，帮助你了解费用是如何计算的。

## 计费原理

QCode.cc 基于 **token 用量** 进行计费。每次调用 AI 模型时，费用由两部分组成：

- **输入 tokens（Input Tokens）**：你发送给模型的内容，包括提示词、上下文、文件内容等

- **输出 tokens（Output Tokens）**：模型生成的回复内容

> **什么是 Token？** Token 是模型处理文本的基本单位。英文中，1 个 token 大约对应 4 个字符或 ¾ 个单词；中文中，1 个汉字通常对应 1-2 个 token。

费用计算公式：

```
总费用 = 输入 tokens × 输入单价 + 输出 tokens × 输出单价
```

## 定价数据来源

### 价格是怎么算出来的

```
QCode 价格 = 官方 API 价格 × 服务费率
```

**服务费率**是路由代理服务费，由平台按服务商统一设定，不同服务商可能不同。每个模型的最终单价与当前费率都在 [qcode.cc/models](https://qcode.cc/models) 顶部的费率卡片区——那也是计费采用的唯一基准数据源。

另外，厂商**公示的是 API 调用的标价**，但并未公开其内部 token 统计的完整计算规则（例如：系统提示词是否计入、tool use 的 token 如何统计、缓存命中如何计价等）。这是估算值与实际账单之间还会有小幅出入的原因。

### qcode.cc/models 定价表

为了确保计费的**透明性和公允性**，QCode.cc 以官方模型页 **qcode.cc/models** 维护的模型定价表作为计费基准：

**数据源地址：** [qcode.cc/models](https://qcode.cc/models)

**为什么以 qcode.cc/models 为准？**

- **实时同步**：模型页定价随厂商调价及时更新

- **统一口径**：与控制台计费、套餐配额使用同一份定价数据

- **覆盖全面**：涵盖 Anthropic、OpenAI、Google 等主流模型厂商的所有模型

- **公开透明**：所有定价公开可查，任何人都可以核对验证

- **及时更新**：模型厂商调价后会及时更新定价数据

## 支持的模型家族

QCode 支持 **七个模型家族**：Claude、GPT / Codex、Gemini、GLM、Kimi、DeepSeek、Qwen。**没有 grok。**

四个国产家族（GLM / Kimi / DeepSeek / Qwen）与前三家共用同一把 `cr_` 密钥、同一套接入点。在售 id（如 `glm-5.2`、`kimi-k3`、`deepseek-v4-pro`、`qwen3.7-max`）以 [qcode.cc/models](https://qcode.cc/models) 为准，协议和模型名怎么填见 [国产模型接入](/docs/usage/cn-models)。

## 主要模型定价参考

以下是常用模型的定价（单位：美元 / 百万 tokens）：

### 主力模型定价

各模型的**实时单价**（输入 / 输出 / 缓存）请直接查看 **[qcode.cc/models](https://qcode.cc/models)** —— 这是计费采用的唯一基准数据源，本页不再维护数字副本，避免与实际计费出现偏差。

量级速览（以 Haiku 4.5 输入单价为 1×）：

- **Claude 系**：Haiku 4.5（1×）< Sonnet 5（≈2×）< Sonnet 4.6（≈3×）< Opus 5 / 4.8（≈5×）< Fable 5（≈10×）
- **GPT 系**：gpt-5.6 家族（terra / sol / luna / mini / nano）与 gpt-5.5、gpt-5.4 的单价见 models 页

> 可用模型清单可随时带密钥 GET `https://api.qcode.cc/v1/models` 查询。

### 关于缓存定价

部分模型（如 Claude 系列）支持 **Prompt Caching**，即对重复使用的上下文内容进行缓存。缓存相关定价：

- **缓存写入（Cache Write）**：首次将内容写入缓存的费用，通常略高于普通输入价格

- **缓存读取（Cache Read）**：命中缓存时的费用，通常为普通输入价格的 10% 左右

缓存机制可以显著降低重复上下文场景下的使用成本。

## 计费示例

假设你使用 claude-sonnet-5 进行一次代码问答：

| 项目 | 数量 | 单价 | 费用 |
|------|------|------|------|
| 输入 tokens | 5,000 | $2.00 / 百万 | $0.010 |
| 输出 tokens | 2,000 | $10.00 / 百万 | $0.020 |
| **合计** | | | **$0.030** |

实际使用中，Claude Code 的一次完整交互通常包含多轮 API 调用（分析代码、生成方案、执行操作等），因此实际费用会高于单次调用。

## 价格更新机制

- QCode.cc **定期同步** qcode.cc/models 的最新定价数据

- 当模型厂商宣布调价后，qcode.cc/models 会及时更新定价，我们会随之同步

- 价格更新对已产生的历史费用没有影响，仅影响更新后的新用量

## 如何查看用量

### Dashboard（推荐）

登录 [QCode.cc 控制台](https://qcode.cc/dashboard)，在「使用统计」页面可以查看：

- **模型调用明细**：每次调用的模型、token 数量和费用

- **费用汇总**：按日、按月的费用统计

- **套餐消耗进度**：当前订阅套餐的配额使用情况

### CLI 内查看

在 Claude Code 中使用 `/cost` 命令快速查看当前会话的用量概况：

```
/cost
```

> **提示**：`/cost` 显示的费用为概估值，建议以 Dashboard 数据为准。

## 常见问题

### 你们的价格和官方价格一样吗？

不完全一样。QCode 价格 = 官方 API 价格 × **服务费率**，费率是路由代理服务费，由平台按服务商统一设定。每个模型的最终单价与当前费率见 [qcode.cc/models](https://qcode.cc/models)，那是计费采用的唯一基准。

另外，厂商内部的 token 计数规则并未完全公开，所以 CLI 自带的 `/cost` 估算与 Dashboard 的实际扣费之间还可能有微小差异。

### 定价数据多久更新一次？

我们定期与 qcode.cc/models 数据源同步。通常在厂商宣布调价后数日内完成更新。

### 如何自行验证价格？

你可以直接查看 qcode.cc/models 的定价数据：

1. 访问 [qcode.cc/models](https://qcode.cc/models)

2. 搜索你使用的模型名称（如 `claude-sonnet-5`）

3. 查看该模型的输入价格和输出价格

4. 价格以每百万 tokens 计价

### 为什么使用公开定价表而不是自定义价格？

选择公开、透明的统一数据源是为了确保公允性。qcode.cc/models 的定价表公开可查，任何人都可以审查和验证，避免了定价争议。

---

> **企业用户**：QCode 企业团队版支持**对公转账**和**正规增值税发票**，可签署正式服务协议。人均低至 ¥320/月，详见 [企业版指南](/docs/reference/enterprise-guide) 或咨询 [qcode.cc/enterprise](https://qcode.cc/enterprise)。

## 相关页面

- [套餐定价](https://qcode.cc/pricing) — 查看当前在售套餐和折扣
- [模型与定价](https://qcode.cc/models) — 查看所有支持模型的实时定价和费率
- [国产模型接入](/docs/usage/cn-models) — GLM / Kimi / DeepSeek / Qwen 的路径与 id
- [常见问题（FAQ）](/docs/reference/faq) — 退款、发票、额度等产品与账务问题