NEW OpenAI 与 Anthropic 协议现已通过同一网关统一接入
GatewayDOCS
⌘ K
GATEWAY DOCUMENTATION v1

一个入口,连接你的
所有大模型。

通过一把 API Key 使用多个大模型。兼容常见 OpenAI 与 Anthropic 客户端,并可在用户面板查看额度和调用记录。

OpenAI Base URL正在读取…
01
OpenAI 兼容

适用于 OpenAI SDK、Cursor、Codex 及常见兼容客户端。

/v1/chat/completions
02
Anthropic 兼容

适用于 Claude Code 与使用 Messages API 的 Agent 工具。

/v1/messages
03
统一套餐额度

所有可用模型共享套餐额度,用量与费用清晰可查。

5h · week · month
i
按你的客户端选择协议即可

同一个可用模型可以从 OpenAI 或 Anthropic 入口调用。网关会自动适配请求、流式响应与工具调用,无需关心模型原本使用哪种接口。

CONFIG GENERATOR

一键生成客户端配置

按照五个步骤选择你的使用方式,页面会生成可以直接复制的配置。API Key 只在当前浏览器页面中使用,不会上传到第三方。

重要提示请使用本页生成的网关地址。客户端内置的厂商预设地址通常会连接到其他服务。
1

输入 API Key

卡密就是 API Key,格式为 gw_...

Key 仅保存在当前页面内存中
2

选择工具

3

选择操作系统

4

选择模型

5

生成配置

选择工具和模型后自动生成

请先输入 API Key,并点击“验证并读取模型”。
QUICK START

快速开始

只需 API Key、Base URL 和模型名三项信息,即可完成第一次调用。

!
请使用网关地址

不要选择客户端内置的厂商直连地址。OpenAI 客户端填写 ;Anthropic 客户端填写根地址

1
获取 API Key

完整 Key 仅在首次获取时显示,格式为 gw_...,请妥善保存。

2
选择对外模型名

调用 GET /v1/models 查看当前套餐允许使用的模型。

3
发送请求

在 Authorization 或 x-api-key Header 中携带 Key。

第一次模型调用
curl __BASE__/v1/chat/completions \
  -H "Authorization: Bearer gw_your_api_key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "your-model",
    "messages": [{"role": "user", "content": "你好"}],
    "stream": false
  }'
from openai import OpenAI

client = OpenAI(
    api_key="gw_your_api_key",
    base_url="__BASE__/v1",
)

response = client.chat.completions.create(
    model="your-model",
    messages=[{"role": "user", "content": "你好"}],
)
print(response.choices[0].message.content)
import OpenAI from "openai";

const client = new OpenAI({
  apiKey: "gw_your_api_key",
  baseURL: "__BASE__/v1",
});

const response = await client.chat.completions.create({
  model: "your-model",
  messages: [{ role: "user", content: "你好" }],
});
console.log(response.choices[0].message.content);
curl __BASE__/v1/messages \
  -H "x-api-key: gw_your_api_key" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "your-model",
    "max_tokens": 1024,
    "messages": [{"role": "user", "content": "你好"}]
  }'
CLIENT SETUP

客户端配置

在支持自定义 API 服务的客户端中,按协议填写下面四项即可。模型名可通过 GET /v1/models 获取。

配置项OpenAI 兼容客户端Anthropic / Claude Code
服务类型OpenAI Compatible / 自定义 OpenAIAnthropic
Base URL
API Keygw_...gw_...
模型填写套餐内可用的对外模型名填写套餐内可用的对外模型名
i
出现 404 时先检查 Base URL

OpenAI 兼容客户端通常填写包含 /v1 的地址;Claude Code 填写不含 /v1 的根地址。

AUTHENTICATION

身份验证

无需注册账号。每个请求使用已发放的 API Key 验证身份,并关联对应套餐与使用记录。

OpenAI 协议Authorization: Bearer <API_KEY>

推荐用于 OpenAI SDK 和兼容客户端。

Anthropic 协议x-api-key: <API_KEY>

推荐用于 Claude Code 与 Messages API。

完整 Key 不会再次显示

请在首次发卡时安全保存。用户面板只返回前缀和掩码,不会把完整 Key 回传到浏览器。

MODELS

获取可用模型

GET /v1/models 返回当前 API Key 可以使用的模型列表。

GET/v1/models需要 API Key
curl __BASE__/v1/models \
  -H "Authorization: Bearer gw_your_api_key"

请求时请使用返回结果中的模型 id。如果客户端不能自动加载模型,也可以手动填写该名称。

OPENAI COMPATIBLE

Chat Completions

POST/v1/chat/completions支持流式响应

兼容常用的 modelmessagesmax_tokenstemperaturestream 参数。

字段类型说明
modelstring必填,对外模型名
messagesarray必填,对话消息数组
max_tokensinteger可选,受套餐单请求输出限制约束
streamboolean可选,套餐可以禁止流式请求

需要逐字输出时将 stream 设置为 true。请求完成后可在用户面板查看 Token 与费用记录。

OPENAI COMPATIBLE

Responses API

POST/v1/responses统一响应接口

适用于使用 OpenAI Responses API 的客户端。模型权限、套餐额度、RPM、TPM 和最大输出限制同样生效。

curl __BASE__/v1/responses \
  -H "Authorization: Bearer gw_your_api_key" \
  -H "Content-Type: application/json" \
  -d '{"model":"your-model","input":"用一句话解释 API 网关"}'
ANTHROPIC COMPATIBLE

Anthropic Messages

POST/v1/messagesClaude Code 可用

使用 Anthropic 协议时请填写网关根地址,不要额外重复拼接 /v1。请求必须包含 x-api-key,客户端提供的 anthropic-version 会被转发。

环境变量示例
ANTHROPIC_BASE_URL=__BASE__
ANTHROPIC_AUTH_TOKEN=gw_your_api_key

缓存读取和缓存创建产生的 Token 会计入使用记录,并按对应模型价格结算。

SUBSCRIPTION

套餐额度

套餐不为每个模型分配固定 Token 数,而是提供统一的 $ 额度池。不同模型通过各自的输入价和输出价消耗同一份额度。

5H首次使用后计时

额度为 0 时不启动窗口;有限额度的 Key 第一次成功进入网关时启动五小时窗口。

W首次使用后计时 7 天

有限额时从该 Key 第一次使用开始,同一 Key 的所有允许模型共用。

M首次使用后计时 30 天

有限额时从该 Key 第一次使用开始,并与五小时和周额度同时约束。

额度项设置为 0开始与重置统计口径
5h 额度不限,不开始计时首次请求开始,五小时后重置所有模型的实际费用
周额度不限首次使用后 7 天所有模型的实际费用
月额度不限首次使用后 30 天所有模型的实际费用
$
额度统一用 $ 表示

模型价格统一为 $/M Token。套餐页面显示的是费用额度,不是固定 Token 数,因此不同价格的模型可使用量会不同。

少量剩余额度仍可完成一次请求

只要任一生效周期仍有正数余额,请求就可以完整执行。额度按 5 小时→周→月顺序级联;短周期不足时自动转入下一个周期,结算短缺会保留为欠费并由后续周期优先抵扣。

BILLING

计费规则

支持按次、按量和混合计费。请求成功后按实际 Token 用量结算,失败请求不计费。

请求费用=按次价格+输入 Token × 输入价 / 1M+输出 Token × 输出价 / 1M
01按次计费

每次成功请求收取固定费用。

+
02按量计费

输入与输出 Token 分别按模型价格计算。

=
03混合计费

同时计算固定费用与 Token 费用。

具体计费方式、套餐额度与余额可在用户面板查看。费用记录会显示到每次请求。

RATE LIMIT

限速与并发

每个 API Key 都有独立的 RPM、TPM 和并发限制,当前数值可在用户面板查看。

RPMRequests Per Minute

每 60 秒允许的请求次数。

TPMTokens Per Minute

每 60 秒允许的输入与输出 Token 总量。

并发Concurrent Requests

同一 Key 同时处理中的请求数。

当 RPM 或 TPM 受限时,响应会携带标准化的限速信息:

x-ratelimit-limit-requests: 60
x-ratelimit-remaining-requests: 42
x-ratelimit-reset-requests: 1784300000
retry-after: 12
ERRORS

常见错误码

HTTPcode含义与处理
401invalid_api_keyKey 不存在或已删除,检查 Header 与完整 Key。
402insufficient_balance套餐额度无法覆盖且超额余额不足,调整额度或余额。
403model_not_allowed当前套餐未开放该对外模型。
429rpm_limit_exceededRPM 已用完,按照 retry-after 稍后重试。
429tpm_limit_exceededTPM 已用完,减少上下文或等待窗口滚动。
429budget_*_exceeded5h、周或月套餐额度已用完。
502upstream_unavailable模型服务暂时无法响应,请稍后重试。
503model_unavailable该模型暂时不可用,请选择其他模型或联系支持。
{
  "error": {
    "type": "quota_exceeded",
    "code": "rpm_limit_exceeded",
    "message": "每分钟请求次数已达到上限",
    "reset_at": "2026-07-18T03:00:00.000Z"
  }
}
FAQ

常见问题

OpenAI Base URL 应该填什么?

填写 。代码中的接口路径由 OpenAI SDK 自动拼接,不要再手动添加 /chat/completions

如何进入用户面板?

在用户面板输入完整 API Key 即可查看套餐、额度和调用记录,无需单独注册账号。

额度显示的是 Token 还是 $?

套餐额度统一显示为 $。每次请求根据对应模型的输入价、输出价和实际 Token 数换算成费用,再消耗共享额度。

5 小时额度什么时候开始?

有限额时,从该 Key 第一次使用开始计时。设置为 0 表示不限,同时不会启动五小时窗口。

周额度和月额度什么时候开始?

与 5 小时额度相同,有限额时从该 Key 第一次使用开始计时;周额度连续 7 天,月额度连续 30 天。额度为 0 时对应窗口不会启动。

在哪里查看可用模型名?

可调用 GET /v1/models,也可在支持自动加载模型的客户端中刷新模型列表。