平台与端点兼容矩阵
QuotaAPI 会先读取 API Key 绑定的分组,再按平台和模型映射选择处理路径。接口路由存在并不代表所有分组都支持该能力。
核心端点
| 端点 | OpenAI | Grok | DeepSeek | 其他兼容平台 |
|---|---|---|---|---|
POST /v1/messages | 协议桥接 | 协议桥接 | Gateway 转换 | 原生或 Gateway 转换 |
POST /v1/chat/completions | OpenAI 兼容处理 | OpenAI 兼容处理 | OpenAI 兼容处理 | 支持时由 Gateway 转换 |
POST /v1/responses | 支持 | 支持 | 不支持,返回 404 | 支持时由 Gateway 转换 |
GET /v1/responses | Responses WebSocket | Responses WebSocket | 不支持 | 不支持 |
POST /v1/embeddings | 支持 | 不支持 | 不支持 | 不支持 |
POST /v1/messages/count_tokens | 桥接统计 | 本地估算 | 不支持 | 原生统计路径 |
POST /v1/images/generations | 支持 | 支持 | 不支持 | 不支持 |
POST /v1/images/edits | 支持 | 支持 | 不支持 | 不支持 |
POST /v1/videos/generations | 不支持 | 支持 | 不支持 | 不支持 |
“其他兼容平台”表示 Anthropic、Gemini、Vertex 等由 Gateway 原生处理或转换的平台。最终能力还取决于账号、渠道、模型和分组配置。
Gemini 原生接口
Gemini SDK 和 Gemini CLI 使用 /v1beta:
| 方法 | 路径 | 用途 |
|---|---|---|
| GET | /v1beta/models | 模型列表 |
| GET | /v1beta/models/:model | 单个模型 |
| POST | /v1beta/models/{model}:generateContent | 非流式生成 |
| POST | /v1beta/models/{model}:streamGenerateContent | 流式生成 |
Key 必须绑定可处理 Gemini 协议和目标模型的分组。
Usage、Live 与模型列表
GET /v1/models返回当前 Key 可访问的模型;Codex 可以附带client_version获取客户端清单格式。GET /v1/usage返回当前 Key 的用量信息。POST /v1/live与GET /v1/live/:call_id用于支持实时调用的 Codex/OpenAI 工作流。- 不带
/v1的/responses、/models、/messages/count_tokens等别名适用于明确需要这些路径的客户端。
Composite 组合分组
Composite 仍然是一个分组。Gateway 根据请求模型映射出目标平台后,再按上表判断端点能力。例如同一个 Composite 分组中的 OpenAI 模型可以调用 Embeddings,而映射到 Grok 的模型不能因此获得 Embeddings。
如何选择
- 先确认 Key 绑定的分组平台。
- 在控制台确认模型位于该分组或 Composite 映射中。
- 根据客户端选择 OpenAI、Anthropic Messages 或 Gemini v1beta 接口。
- 对不确定的端点先发送最小请求,再在用量记录中检查原始状态码。
