适用于 OpenAI SDK、Cursor、Codex 及常见兼容客户端。
/v1/chat/completions通过一把 API Key 使用多个大模型。兼容常见 OpenAI 与 Anthropic 客户端,并可在用户面板查看额度和调用记录。
正在读取…适用于 OpenAI SDK、Cursor、Codex 及常见兼容客户端。
/v1/chat/completions适用于 Claude Code 与使用 Messages API 的 Agent 工具。
/v1/messages所有可用模型共享套餐额度,用量与费用清晰可查。
5h · week · month同一个可用模型可以从 OpenAI 或 Anthropic 入口调用。网关会自动适配请求、流式响应与工具调用,无需关心模型原本使用哪种接口。
按照五个步骤选择你的使用方式,页面会生成可以直接复制的配置。API Key 只在当前浏览器页面中使用,不会上传到第三方。
卡密就是 API Key,格式为 gw_...
选择工具和模型后自动生成
请先输入 API Key,并点击“验证并读取模型”。只需 API Key、Base URL 和模型名三项信息,即可完成第一次调用。
不要选择客户端内置的厂商直连地址。OpenAI 客户端填写 ;Anthropic 客户端填写根地址 。
完整 Key 仅在首次获取时显示,格式为 gw_...,请妥善保存。
调用 GET /v1/models 查看当前套餐允许使用的模型。
在 Authorization 或 x-api-key Header 中携带 Key。
curl __BASE__/v1/chat/completions \
-H "Authorization: Bearer gw_your_api_key" \
-H "Content-Type: application/json" \
-d '{
"model": "your-model",
"messages": [{"role": "user", "content": "你好"}],
"stream": false
}'
from openai import OpenAI
client = OpenAI(
api_key="gw_your_api_key",
base_url="__BASE__/v1",
)
response = client.chat.completions.create(
model="your-model",
messages=[{"role": "user", "content": "你好"}],
)
print(response.choices[0].message.content)
import OpenAI from "openai";
const client = new OpenAI({
apiKey: "gw_your_api_key",
baseURL: "__BASE__/v1",
});
const response = await client.chat.completions.create({
model: "your-model",
messages: [{ role: "user", content: "你好" }],
});
console.log(response.choices[0].message.content);
curl __BASE__/v1/messages \
-H "x-api-key: gw_your_api_key" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{
"model": "your-model",
"max_tokens": 1024,
"messages": [{"role": "user", "content": "你好"}]
}'
在支持自定义 API 服务的客户端中,按协议填写下面四项即可。模型名可通过 GET /v1/models 获取。
| 配置项 | OpenAI 兼容客户端 | Anthropic / Claude Code |
|---|---|---|
| 服务类型 | OpenAI Compatible / 自定义 OpenAI | Anthropic |
| Base URL | | |
| API Key | gw_... | gw_... |
| 模型 | 填写套餐内可用的对外模型名 | 填写套餐内可用的对外模型名 |
OpenAI 兼容客户端通常填写包含 /v1 的地址;Claude Code 填写不含 /v1 的根地址。
无需注册账号。每个请求使用已发放的 API Key 验证身份,并关联对应套餐与使用记录。
Authorization: Bearer <API_KEY>推荐用于 OpenAI SDK 和兼容客户端。
x-api-key: <API_KEY>推荐用于 Claude Code 与 Messages API。
请在首次发卡时安全保存。用户面板只返回前缀和掩码,不会把完整 Key 回传到浏览器。
GET /v1/models 返回当前 API Key 可以使用的模型列表。
/v1/models需要 API Keycurl __BASE__/v1/models \
-H "Authorization: Bearer gw_your_api_key"
请求时请使用返回结果中的模型 id。如果客户端不能自动加载模型,也可以手动填写该名称。
/v1/chat/completions支持流式响应兼容常用的 model、messages、max_tokens、temperature 和 stream 参数。
| 字段 | 类型 | 说明 |
|---|---|---|
model | string | 必填,对外模型名 |
messages | array | 必填,对话消息数组 |
max_tokens | integer | 可选,受套餐单请求输出限制约束 |
stream | boolean | 可选,套餐可以禁止流式请求 |
需要逐字输出时将 stream 设置为 true。请求完成后可在用户面板查看 Token 与费用记录。
/v1/responses统一响应接口适用于使用 OpenAI Responses API 的客户端。模型权限、套餐额度、RPM、TPM 和最大输出限制同样生效。
curl __BASE__/v1/responses \
-H "Authorization: Bearer gw_your_api_key" \
-H "Content-Type: application/json" \
-d '{"model":"your-model","input":"用一句话解释 API 网关"}'
/v1/messagesClaude Code 可用使用 Anthropic 协议时请填写网关根地址,不要额外重复拼接 /v1。请求必须包含 x-api-key,客户端提供的 anthropic-version 会被转发。
ANTHROPIC_BASE_URL=__BASE__
ANTHROPIC_AUTH_TOKEN=gw_your_api_key缓存读取和缓存创建产生的 Token 会计入使用记录,并按对应模型价格结算。
套餐不为每个模型分配固定 Token 数,而是提供统一的 $ 额度池。不同模型通过各自的输入价和输出价消耗同一份额度。
额度为 0 时不启动窗口;有限额度的 Key 第一次成功进入网关时启动五小时窗口。
有限额时从该 Key 第一次使用开始,同一 Key 的所有允许模型共用。
有限额时从该 Key 第一次使用开始,并与五小时和周额度同时约束。
| 额度项 | 设置为 0 | 开始与重置 | 统计口径 |
|---|---|---|---|
| 5h 额度 | 不限,不开始计时 | 首次请求开始,五小时后重置 | 所有模型的实际费用 |
| 周额度 | 不限 | 首次使用后 7 天 | 所有模型的实际费用 |
| 月额度 | 不限 | 首次使用后 30 天 | 所有模型的实际费用 |
模型价格统一为 $/M Token。套餐页面显示的是费用额度,不是固定 Token 数,因此不同价格的模型可使用量会不同。
只要任一生效周期仍有正数余额,请求就可以完整执行。额度按 5 小时→周→月顺序级联;短周期不足时自动转入下一个周期,结算短缺会保留为欠费并由后续周期优先抵扣。
支持按次、按量和混合计费。请求成功后按实际 Token 用量结算,失败请求不计费。
按次价格+输入 Token × 输入价 / 1M+输出 Token × 输出价 / 1M每次成功请求收取固定费用。
输入与输出 Token 分别按模型价格计算。
同时计算固定费用与 Token 费用。
具体计费方式、套餐额度与余额可在用户面板查看。费用记录会显示到每次请求。
每个 API Key 都有独立的 RPM、TPM 和并发限制,当前数值可在用户面板查看。
每 60 秒允许的请求次数。
每 60 秒允许的输入与输出 Token 总量。
同一 Key 同时处理中的请求数。
当 RPM 或 TPM 受限时,响应会携带标准化的限速信息:
x-ratelimit-limit-requests: 60
x-ratelimit-remaining-requests: 42
x-ratelimit-reset-requests: 1784300000
retry-after: 12
| HTTP | code | 含义与处理 |
|---|---|---|
| 401 | invalid_api_key | Key 不存在或已删除,检查 Header 与完整 Key。 |
| 402 | insufficient_balance | 套餐额度无法覆盖且超额余额不足,调整额度或余额。 |
| 403 | model_not_allowed | 当前套餐未开放该对外模型。 |
| 429 | rpm_limit_exceeded | RPM 已用完,按照 retry-after 稍后重试。 |
| 429 | tpm_limit_exceeded | TPM 已用完,减少上下文或等待窗口滚动。 |
| 429 | budget_*_exceeded | 5h、周或月套餐额度已用完。 |
| 502 | upstream_unavailable | 模型服务暂时无法响应,请稍后重试。 |
| 503 | model_unavailable | 该模型暂时不可用,请选择其他模型或联系支持。 |
{
"error": {
"type": "quota_exceeded",
"code": "rpm_limit_exceeded",
"message": "每分钟请求次数已达到上限",
"reset_at": "2026-07-18T03:00:00.000Z"
}
}
填写 。代码中的接口路径由 OpenAI SDK 自动拼接,不要再手动添加 /chat/completions。
在用户面板输入完整 API Key 即可查看套餐、额度和调用记录,无需单独注册账号。
套餐额度统一显示为 $。每次请求根据对应模型的输入价、输出价和实际 Token 数换算成费用,再消耗共享额度。
有限额时,从该 Key 第一次使用开始计时。设置为 0 表示不限,同时不会启动五小时窗口。
与 5 小时额度相同,有限额时从该 Key 第一次使用开始计时;周额度连续 7 天,月额度连续 30 天。额度为 0 时对应窗口不会启动。
可调用 GET /v1/models,也可在支持自动加载模型的客户端中刷新模型列表。