Skip to content

用量与 Token 统计 API

用量接口用于读取 Key 的消费信息,Token 统计用于请求前估算输入规模。二者不能互相替代,最终扣费以完成请求后的用量记录为准。

鉴权

以下 /v1 接口使用与当前协议一致的 API Key。通用 curl 示例使用 Bearer Token:

bash
curl https://quotarouter.ai/v1/usage \
  -H "Authorization: Bearer YOUR_QUOTAAPI_KEY"

端点

方法路径说明
GET/v1/usage当前 Key 的用量信息
GET/v1/models当前 Key 可见模型
POST/v1/messages/count_tokens统计 Messages 请求输入 Token
POST/messages/count_tokens/v1 的客户端兼容别名
POST/v1/live创建支持的实时调用
GET/v1/live/:call_id读取实时调用 sideband 信息

Token 统计

bash
curl https://quotarouter.ai/v1/messages/count_tokens \
  -H "x-api-key: YOUR_QUOTAAPI_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-sonnet-4.5",
    "messages": [{ "role": "user", "content": "Count this request." }]
  }'

典型响应:

json
{
  "input_tokens": 12
}

平台行为:OpenAI 使用桥接统计,Grok 使用本地估算,DeepSeek 返回不支持,其他平台沿用原生统计路径。估算值不包含生成后的输出 Token。

模型列表

bash
curl "https://quotarouter.ai/v1/models?client_version=1.0.0" \
  -H "Authorization: Bearer YOUR_QUOTAAPI_KEY"

Codex 客户端带 client_version 时可获得适配的模型清单;其他客户端获得常规模型列表。返回仍受 Key 分组和模型映射约束。

Live 接口

Live 适用于明确支持实时调用的 Codex/OpenAI 工作流。创建成功后保存 call_id,通过 /v1/live/:call_id 查询对应 sideband 数据。普通 Chat Completions 和 Messages 客户端不需要调用 Live。

与控制台记录的关系

控制台 /usage 页面记录完成请求的模型、Token、费用、延迟和状态。预估接口成功不代表后续生成一定成功,也不代表最终费用已经确定。

QuotaAPI 是面向开发者和团队的 AI API 中转服务。