> ## Documentation Index
> Fetch the complete documentation index at: https://docs.sub2api.ruilinlu.com/llms.txt
> Use this file to discover all available pages before exploring further.

# 如何查询 API 用量？

> 介绍在 Sub2API 控制台中查看用量明细，以及如何从 API 响应中实时获取 Token 用量。

Sub2API 支持两种查询 API 用量的方式：通过控制台查看历史用量汇总，或在每次 API 调用后读取响应中的实时 Token 数据。两种方式互补，分别适用于账单核对和程序内控。

## 方法一：控制台查看用量

登录 [Sub2API 控制台](https://sub2api.ruilinlu.com/login)，进入用量统计页面即可查看：

* 按时间维度的总 Token 消耗
* 按模型维度的调用次数和费用
* 历史趋势图表

<Info>
  控制台目前仅支持查询过去的用量数据，无法实时显示刚刚发生的请求。
</Info>

详细的查询步骤和筛选操作，请参考 [用量查询指南](/billing/usage-query)。

## 方法二：从 API 响应中读取用量

如果你需要在代码中实时获知一次请求消耗了多少 Token，可以直接解析 API 返回的 JSON 数据。

### 响应格式示例

```json theme={null}
{
  "usage": {
    "prompt_tokens": 10,
    "completion_tokens": 50,
    "total_tokens": 60
  }
}
```

各字段含义如下：

| 字段                  | 含义                           |
| ------------------- | ---------------------------- |
| `prompt_tokens`     | 输入文本（包括系统提示和用户消息）消耗的 Token 数 |
| `completion_tokens` | 模型生成内容消耗的 Token 数            |
| `total_tokens`      | 本次请求总计消耗的 Token 数            |

### Python 读取示例

```python theme={null}
from openai import OpenAI

client = OpenAI(
    base_url="https://sub2api.ruilinlu.com/v1",
    api_key="YOUR_API_KEY",
)

response = client.chat.completions.create(
    model="gpt-4o",
    messages=[{"role": "user", "content": "Hello"}]
)

# 打印总 Token 用量
print(response.usage.total_tokens)
```

输出示例：

```bash theme={null}
60
```

<Tip>
  建议在批量调用场景中，累加每次请求的 `total_tokens`，以便在任务结束时输出总消耗。
</Tip>

## 费用与计费说明

Sub2API 采用按 Token 计费模式，即根据每次请求实际消耗的 Token 数量扣费。不同模型的单价不同。

> TODO：请在后台确认实际配置后填写。具体定价信息需在控制台确认。具体定价信息需在控制台确认。

关于计费规则和费率说明，请参阅 [Token 计费说明](/billing/token-billing)。
