多模型统一聚合
GPT、Claude、Gemini、DeepSeek、Grok、Qwen、Kimi、豆包……几十家厂商上百个模型收在同一个接口下,切换模型只改 model 参数,不改任何调用代码。
兼容 OpenAI / Anthropic 协议 · 国内直连 · 支付宝微信充值
API中转站把 GPT、Claude、Gemini、DeepSeek、Grok、Qwen 等主流大模型收敛到同一个 Base URL 和同一把 API Key 之下。不用外币信用卡、不用折腾网络环境、不用为每家厂商单独接一遍 SDK—— 改一行地址,原有代码原样跑通,按 token 用多少付多少。
支持 Claude Code · Cursor · Codex · Cline · Dify · LobeChat · ChatBox 等全部 OpenAI 兼容客户端
# 1. 原来调官方
export OPENAI_BASE_URL="https://api.openai.com/v1"
# 2. 换成 API中转站,其余代码一行不用改
export OPENAI_BASE_URL="https://你的中转站域名/v1"
export OPENAI_API_KEY="sk-xxxxxxxxxxxxxxxx"
# 3. 立刻可用,模型随便换
curl "$OPENAI_BASE_URL/chat/completions" \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-d '{"model":"claude-sonnet-4-5",
"messages":[{"role":"user","content":"你好"}]}'
一句话:API中转站是站在开发者和模型厂商之间的转发 + 聚合服务,本质上是「大模型 API 的代购商 + 统一网关」。
你的程序原本要直接请求 api.openai.com、api.anthropic.com、
generativelanguage.googleapis.com——三家厂商,三套鉴权,三种计费,三张外币信用卡。
接上 API中转站之后,这些请求全部先发到中转站,由中转站按你指定的模型名转发给对应上游,
再把结果原样返回。对你的代码来说,只是 Base URL 变了一个字符串,其余完全不变。
技术上,绝大多数 API中转站的底层跑的是开源项目 One API 或它的衍生版 New API, Docker 一条命令就能部署。它们负责把不同厂商的协议统一转换成 OpenAI 兼容格式, 并提供渠道管理、令牌管理、分组倍率、用量统计、负载均衡这一整套后台能力。 所以你会发现市面上大部分中转站后台长得很像——因为它们本来就是同一个开源系统。
也正因为门槛低,这个行业鱼龙混杂:有认真做官方渠道批发的,也有靠逆向号池打价格战的, 还有干脆虚报 token、拿小模型冒充大模型的。选对站比省那点差价重要得多, 这也是本页后半部分重点讲的内容。
官方 API 只收 Visa / MasterCard 等外币卡,还常常风控拒付。中转站支持支付宝、微信直接充值,几元起充,余额按量扣减。
官方接口域名在国内访问不稳定,服务器部署在境内时更麻烦。中转站提供国内可直连的线路,本地开发、云服务器、CI 环境都能直接请求。
官方按 token 原价计费,长期高频调用开销可观。中转站通过批量采购与分组倍率下调实际单价,同一个模型可以按需要选不同价位的渠道。
不用为 OpenAI、Anthropic、Google 各写一套调用逻辑。统一 OpenAI 兼容格式后,换模型只是改一个 model 字段的事。
不是「便宜一点的 OpenAI」这么简单。一个成熟的 API中转站,实际承担的是团队大模型网关的角色。
GPT、Claude、Gemini、DeepSeek、Grok、Qwen、Kimi、豆包……几十家厂商上百个模型收在同一个接口下,切换模型只改 model 参数,不改任何调用代码。
提供境内可直接访问的线路,本机开发、国内云服务器、Docker 容器、GitHub Actions 都能直连,不必再为每台机器配代理。
无需外币信用卡,无需 PayPal,无需境外手机号。最低通常几元起充,余额按 token 实时扣减,用多少扣多少。
同一个模型提供多个分组:低倍率分组便宜适合批量试验,官转分组稳定适合生产。价格与稳定性自己权衡,不用一刀切。
后台可配置多条上游渠道,某条限速或挂掉时自动切换重试,避免单点故障导致业务中断,这是直连官方单 Key 做不到的。
为每个项目、每个成员单独签发 API Key,分别设置可用模型、额度上限和有效期。谁花了多少一目了然,密钥泄露也能单独吊销。
逐条记录请求时间、模型、输入输出 token、实际扣费与所走渠道,可导出对账。排查「这个月钱花哪了」不再靠猜。
Claude Code、Cursor、Codex、Cline、Roo Code、Dify、LobeChat、ChatBox、NextChat 等只要支持自定义 Base URL,全部一填即用。
做模型选型时,不必为每家厂商都开一次户、绑一次卡。同一份 prompt 在十几个模型上横向对比,只花几块钱。
下表是当前 API中转站普遍覆盖的主流模型家族与典型用途,具体可用列表以所选平台的模型页为准。
| 模型家族 | 代表型号 | 擅长场景 | 调用协议 |
|---|---|---|---|
| Claude | Opus / Sonnet / Haiku | 长上下文代码工程、复杂重构、Agent 编程,Claude Code 的原生模型 | /v1/messages、/v1/chat/completions |
| GPT | GPT 系列 / o 系列推理模型 | 通用对话、函数调用、结构化输出、深度推理 | /v1/chat/completions、/v1/responses |
| Gemini | Gemini Pro / Flash | 超长上下文、多模态图文视频理解、成本敏感的大批量任务 | OpenAI 兼容格式 |
| DeepSeek | V 系列 / R 系列 | 中文场景、数学与代码推理,单价极低适合大批量 | OpenAI 兼容格式 |
| 国产模型 | Qwen、Kimi、GLM、豆包、MiniMax | 中文写作、长文档、合规要求较高的境内业务 | OpenAI 兼容格式 |
| 多模态 / 生成 | 文生图、语音、Embedding、Rerank | 图像生成、语音合成与识别、向量检索与重排 | /v1/images、/v1/audio、/v1/embeddings |
小贴士:同一个模型名在不同中转站可能指向不同来源。Opus 这类高价模型尤其要看清分组—— 标价明显低于官方三折的 Opus 渠道,基本可以判定不是官方直连。
搞懂两个词就够了:渠道决定货是哪来的,倍率决定你付多少钱。 实付成本 = 官方标称价 × 分组倍率 × 实际消耗 token。
| 渠道类型 | 常见倍率 | 稳定性 | 来源说明 | 适合谁 |
|---|---|---|---|---|
| 官方直连 | 1.0 | 极稳 | 厂商官方 API Key,与自己开户调用完全一致 | 企业生产环境、对稳定性零容忍的业务 |
| 云厂商渠道 | 0.8 ~ 1.2 | 极稳 | Azure、AWS Bedrock、Vertex 等云平台转售额度 | 需要发票与合规凭证的企业用户 |
| 官转站 | 0.8 ~ 1.5 | 较稳 | 批量采购官方额度后分销,走量拿折扣 | 个人开发者与中小团队的主力选择 |
| 逆向 / 号池渠道 | 0.05 ~ 0.3 | 波动大 | 逆向网页或订阅协议,大量免费账号轮换调用 | 预算极限、可容忍断流的试验性任务 |
| 分组倍率 | 相当于 | 通常意味着什么 | 建议 |
|---|---|---|---|
| 2.0 | 官方价 2 倍 | 官方直连 + 服务溢价,或高保障 SLA 分组 | 对稳定性有硬要求时值得付 |
| 1.0 | 官方同价 | 标准官转,货真价实,只赚流水不赚差价 | 推荐做主力 |
| 0.5 | 五折 | 批量采购折扣或混合渠道,多数情况仍可用 | 日常开发可用,生产前先实测 |
| 0.2 | 两折 | 大概率掺入逆向或阉割版,上下文可能被削 | 先测长文再上 |
| 0.05 | 五分之一折 | 几乎必然是号池逆向,随时可能限速或断流 | 别放生产 |
换算提醒:token 是计费的最小单位,英文大致 1 个单词≈1 token,中文大致 1 个汉字≈1~2 token。 输出 token 通常比输入贵好几倍,所以让模型「少废话」是最直接的省钱手段; 开启 prompt 缓存、把长系统提示词固定下来复用,也能显著压低账单。
全过程大约五分钟。核心动作只有一个:把 Base URL 换掉,把 Key 换掉。
注册账号后用支付宝或微信小额充值(建议先充 10~20 元),在「令牌」页创建一个 sk- 开头的 API Key,并限定它可用的模型与额度上限。
把代码或客户端里的官方地址换成中转站地址。OpenAI 协议结尾必须带 /v1;Anthropic 协议只填到域名即可,不要多加路径。
跑通第一次请求后,用长文档验上下文、用难题验推理质量、回后台核对 token 消耗。三项都对得上,再考虑加大充值。
# macOS / Linux:写进 ~/.zshrc 或 ~/.bashrc
export ANTHROPIC_BASE_URL="https://你的中转站域名"
export ANTHROPIC_AUTH_TOKEN="sk-xxxxxxxxxxxxxxxx"
# Windows PowerShell
$env:ANTHROPIC_BASE_URL="https://你的中转站域名"
$env:ANTHROPIC_AUTH_TOKEN="sk-xxxxxxxxxxxxxxxx"
# 然后直接启动
claude
Settings → Models → OpenAI API Key
1. 勾选 Override OpenAI Base URL
2. 填入 https://你的中转站域名/v1
↑ 结尾的 /v1 不能省
3. API Key 填 sk-xxxxxxxxxxxxxxxx
4. 点 Verify 验证,通过后关闭内置模型
5. 在模型列表中手动添加中转站支持的模型名
from openai import OpenAI
client = OpenAI(
base_url="https://你的中转站域名/v1",
api_key="sk-xxxxxxxxxxxxxxxx",
)
resp = client.chat.completions.create(
model="claude-sonnet-4-5",
messages=[{"role": "user", "content": "用一句话解释什么是API中转站"}],
)
print(resp.choices[0].message.content)
// Node.js
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://你的中转站域名/v1",
apiKey: process.env.API_KEY,
});
# 先用 curl 确认模型列表能否拉到
curl "https://你的中转站域名/v1/models" \
-H "Authorization: Bearer $API_KEY"
常见报错速查:401 多半是 Key 填错或令牌已过期;404 通常是 Base URL 结尾漏了或多了 /v1;
403 一般是当前令牌所在分组不支持你请求的模型;429 是并发或速率被限,换分组或降并发即可。
这个行业的核心风险不是贵,而是你付了 Opus 的钱,拿到的是 Haiku 的答案,而且你还不知道。
| 内容敏感度 | 举例 | 推荐渠道 |
|---|---|---|
| 低 | 公开资料整理、日常闲聊、翻译润色 | 任意口碑尚可的 API中转站 |
| 中 | 内部文档、非机密业务代码、产品草稿 | 有长期口碑的官转站,选高倍率稳定分组 |
| 高 | 商业机密、客户数据、未公开财务信息 | 官方直连或云厂商渠道,签合规协议 |
| 禁止 | 密码、私钥、身份证、银行卡、医疗记录 | 不要经过任何第三方 API |
记住一条原则:请求内容经过谁的服务器,谁理论上就能看到。中转站省的是钱,赌的是信任, 所以「小额滚动充值 + 多家备份 + 敏感数据不出门」这三件事,比纠结哪家便宜两毛钱重要得多。
看懂这十几个词,逛任何一家中转站的社群都不会再一头雾水。
/v1。搜索「api中转站」的人最常问的八个问题,一次答完。
API中转站是站在你和 OpenAI、Anthropic、Google 之间的转发与聚合服务。官方 API 是一家厂商一套接口、一套鉴权、一张外币卡;API中转站把这些统一成一个 Base URL + 一个 API Key,并额外解决国内支付、网络直连和成本三个问题。
区别在于:官方直连最稳但门槛高、贵;中转站便宜灵活,但服务质量取决于你选的是哪一家、走的是哪个分组。
远不止便宜。它同时是多模型聚合网关(一个密钥调用上百个模型)、国内接入层(免网络工具直连)、成本管理台(子令牌、额度上限、用量日志、按项目分账)和高可用层(多渠道负载均衡与故障自动切换)。
对个人开发者,它省的是开户和绑卡的麻烦;对小团队,它省的是自建网关的工程量。
两条路径,性质完全不同。官转是批量采购官方额度或走云厂商渠道,靠走量拿折扣,倍率通常在 0.8~1.5,质量接近官方。逆向是把网页版或订阅版协议逆向成 API,用成千上万个免费账号组成号池摊薄成本,倍率能压到 0.05~0.3。
所以看到「一折 Opus」不要激动,先问自己:官方成本摆在那儿,这个差价是从哪省出来的?
公式是:实付 = 官方标称价 × 分组倍率 × 实际消耗 token 数。倍率 1 就是官方同价,0.5 就是五折。同一个模型在不同分组里倍率可以差几十倍,所以创建令牌时一定要看清绑定的是哪个分组。
省钱最有效的三个动作:控制输出长度(输出 token 比输入贵数倍)、复用固定的系统提示词以命中缓存、非关键任务降级到更便宜的小模型。
Claude Code:设置 ANTHROPIC_BASE_URL 为中转站域名、ANTHROPIC_AUTH_TOKEN 为你的 API Key,然后直接运行 claude。
Cursor:设置里勾选 Override OpenAI Base URL,填入中转站地址并确保结尾带 /v1,粘入 API Key 后点 Verify 验证即可。
其余支持自定义 Base URL 的客户端(Cline、Dify、LobeChat、ChatBox 等)逻辑完全一致:改地址、填密钥、选模型。详细命令见接入教程。
技术上,请求内容经过谁的服务器,谁就有能力看到。因此要按敏感度分级使用:公开信息随便用;内部文档和非机密代码选有口碑的官转站;商业机密和客户数据走官方直连或云厂商;密码、私钥、身份证这类信息绝不要经过任何第三方 API。
三招实测:一是长文档测试,塞入接近上限的文本,看上下文窗口有没有被缩水;二是固定难题对比,准备三道复杂推理题,与官方输出横向比对,质量断崖式下滑就是被换了模型;三是计费核对,用完全相同的输入连续请求多次,检查后台记录的 token 消耗是否稳定,虚报的站点数字会飘。
基本要不回来——多数中转站没有可查的运营主体,维权成本远高于余额本身。所以正确做法是事前防范:按周或按月小额滚动充值,不囤大额余额;同时准备两到三家备用站,密钥统一写进环境变量,切换只需改一行配置;核心生产业务额外保留少量官方直连额度兜底。
把中转站当成随时可替换的耗材,而不是长期资产,心态和账面都会舒服很多。
API中转站的接入成本几乎为零——改一个 Base URL 而已。真正值得花时间的, 是那套「长文测上下文、难题测降智、日志核 token」的验货流程。 跑一遍,心里就有数了。