高频多轮,缓存决定成败
一次重构任务能触发几十轮请求,每轮都重复带上系统提示词、项目结构和历史对话。支不支持 Prompt Caching,直接决定账单是省一半还是翻一倍。
Anthropic 原生协议 · 支持 Prompt Caching · 国内直连
不用改 Claude Code 本身,不用装插件,不用挂代理。把 ANTHROPIC_BASE_URL 指向中转站、
ANTHROPIC_AUTH_TOKEN 填上密钥,claude 敲下去就能用
claude-opus-5 写代码——而且账单往往只有官方的三分之一。
claude-opus-5claude-sonnet-5claude-fable-5# 兼容 macOS · Linux · Windows · 支付宝微信充值 · 按量计费
# 1. 指向中转站(当前会话临时生效,先验证再固化)
export ANTHROPIC_BASE_URL="https://你的中转站域名"
export ANTHROPIC_AUTH_TOKEN="sk-xxxxxxxxxxxxxxxx"
# 2. 直接启动,无需登录 Anthropic 账号
$ claude
✻ Welcome to Claude Code
model claude-opus-5
api 你的中转站域名
cache enabled (5m)
> 帮我重构 src/parser.ts,拆出纯函数并补测试
⏺ Read(src/parser.ts) 412 lines
⏺ Edit(src/parser.ts) +86 -54
⏺ Write(src/parser.test.ts) 新增 18 个用例
tokens: 3.2k in (2.9k cached) / 1.8k out
接收 Claude Code 的请求,转发给上游,再把响应原样送回。对客户端完全透明——不用改代码、不用装插件、不用登录 Anthropic 账号,它只认 Base URL。
Claude Code 默认把请求发往 api.anthropic.com,走 Anthropic 原生的
/v1/messages 协议,用官方账号或 API Key 鉴权。国内用户会连撞三堵墙:
网络连不上、没有外币卡付不了款、官方 Opus 5 按量计费贵到不敢开。
中转站做的事就是把这三堵墙一次拆掉:它在国内可直连的节点上接住你的请求, 用它自己的上游渠道去调 Anthropic,再把结果返回。你要做的只有一件事—— 告诉 Claude Code 换个地址说话。
服务定位:普通 API 中转站比的是「模型多不多、单价低不低」; Claude Code中转站必须额外满足三个硬条件——支持 Anthropic 原生 /v1/messages 协议、 支持 Prompt Caching、支持长上下文与工具调用。少一条,Claude Code 要么接不上,要么贵到没意义。
Claude Code 的调用模式跟聊天完全不同:它是高频、长上下文、重复携带系统提示词的 Agent 型负载,这让某些指标的权重被急剧放大。
一次重构任务能触发几十轮请求,每轮都重复带上系统提示词、项目结构和历史对话。支不支持 Prompt Caching,直接决定账单是省一半还是翻一倍。
聊天场景慢半秒无所谓,Claude Code 一个任务要来回几十次,每次多 300ms 就是十几秒的等待。国内节点和境外多跳转发的体感差距非常明显。
读文件、改代码、跑命令全靠 tool calling。中转站若砍了工具调用或缩了上下文窗口,Claude Code 会表现为「读不全文件、改一半就断」。
部分逆向接口会在请求里塞入自己的系统提示词,导致模型行为偏离预期——表现为不听指令、乱改文件、忽略项目规范,排查起来极其费神。
Claude Code 走 /v1/messages,不是 OpenAI 的 /v1/chat/completions。只做 OpenAI 兼容格式的中转站,Claude Code 根本连不上。
用中转站不需要登录 Anthropic 账号,避免因地区、多设备、共享等原因触发官方风控导致封号——很多人转中转站的直接原因就是这个。
货源决定质量。价格差十倍,风险也差十倍——先看清自己用的是哪一种。
| 路线 | 货源 | 相对官方价 | Prompt Caching | 稳定性 | 主要风险 |
|---|---|---|---|---|---|
| 官转 | 官方授权 API Key 批量采购 | 约 3~7 折 | 通常支持 | 高 | 平台自身经营风险;涨价随上游波动 |
| 逆向号池 | 逆向订阅/网页协议 + 大量账号轮换 | 约 1~2 折 | 普遍不支持 | 低 | 注入隐性提示词;Anthropic 一更新即整体失效 |
| Max 拼车 | Max 20x 订阅账号多人合用 | 按人头月付 | 看实现 | 中 | 设备数限制;同车有人乱用会拖累全车额度 |
| 官方直连 | 自己开户 + 外币卡 | 原价 | 原生支持 | 最高 | 无渠道风险,但贵、且国内网络与支付门槛高 |
怎么快速判断自己买的是哪种?看三点:① 支不支持 Prompt Caching——逆向渠道几乎都不支持; ② 报价折扣——低于官方两折的 Opus 5 基本不可能是官转; ③ 模型行为——如果 Claude Code 时不时"不听话"、无视 CLAUDE.md 规范,大概率是被注入了隐性系统提示词。
模型标价家家都抄官方美元价,看上去没差别。真正决定账单的是「内部汇率」和「有没有缓存」这两项。
| 内部汇率 | 充 ¥100 得到 | 相当于官方价 | 加权均价参考(¥/百万 token) |
|---|---|---|---|
| ¥2.4 / $1 | 约 $41.7 | 约 1/3 | 约 ¥45.6 |
| ¥4.0 / $1 | 约 $25.0 | 约 55% | 约 ¥76 |
| ¥7.0 / $1 | 约 $14.3 | ≈ 官方 | 约 ¥114~138 |
加权均价按输入 30% / 输出 70% 的典型 Claude Code 负载估算。 结论:横向对比时永远换算成「每百万 token 实付人民币」,只比美元标价等于什么都没比。
Claude Code 每次请求都要重复发送一大坨固定内容:系统提示词、CLAUDE.md 项目规范、 文件树、历史对话。这部分内容在一次会话里几乎不变,却要一遍遍付钱。
开启 Prompt Caching 后,这些重复内容第一次写入缓存(价格略高于普通输入), 后续命中缓存的读取价格通常只有写入价的十分之一左右。 落到 Claude Code 的真实账单上,整体成本可以降低约 50%~70%。
这就导致一个反直觉的结论:一个标价更低但不支持缓存的中转站,长期用下来往往比标价略高但支持缓存的更贵。 逆向号池渠道普遍不支持缓存,它那个"一折"的价格优势,在 Claude Code 场景下会被大幅抵消。
| 场景 | 重复上下文计费方式 | 相对成本 | 适合谁 |
|---|---|---|---|
| 不支持缓存 | 每轮全额按输入价计费 | 100% | 只做单次短对话的场景 |
| 支持 5 分钟缓存 | 连续操作期间按缓存读取价计费 | 约 40~50% | 常规编码会话 |
| 支持 1 小时缓存 | 长时间挂着的会话也能持续命中 | 约 30~40% | 长任务、大项目重构 |
顺序很重要:先临时变量验证,再写永久配置。反过来做,配错了会留下一堆难以排查的残留。
在中转站后台创建令牌,复制 sk- 开头的 API Key。
关键:分清「网站面板地址」和「接口地址(Base URL)」——很多人把浏览器里那个后台网址直接填进去,必然 404。
另外看清服务商文档要求的格式:Anthropic 原生协议一般只填到域名,不要自己补 /v1。
只在当前终端窗口生效,配错了关掉窗口就没了,是最安全的验证方式。
# 临时生效(关掉窗口即失效)
export ANTHROPIC_BASE_URL="https://你的中转站域名"
export ANTHROPIC_AUTH_TOKEN="sk-xxxxxxxxxxxxxxxx"
# 先用 curl 确认通路,再启动 claude
curl "$ANTHROPIC_BASE_URL/v1/messages" \
-H "x-api-key: $ANTHROPIC_AUTH_TOKEN" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{"model":"claude-sonnet-5","max_tokens":32,
"messages":[{"role":"user","content":"ping"}]}'
$ claude
# 当前 PowerShell 会话临时生效
$env:ANTHROPIC_BASE_URL = "https://你的中转站域名"
$env:ANTHROPIC_AUTH_TOKEN = "sk-xxxxxxxxxxxxxxxx"
> claude
# 注意:若之前用 setx 配过永久变量,必须先关掉旧窗口重开,
# 否则读到的还是旧值 —— 这是 Windows 上最常见的"配了没生效"。
验证通过后再固化。推荐写 ~/.claude/settings.json 而不是系统环境变量——
settings.json 里的 env 优先级更高,能覆盖掉之前配过的其他中转站残留,彻底避免多套配置打架。
{
"env": {
"ANTHROPIC_BASE_URL": "https://你的中转站域名",
"ANTHROPIC_AUTH_TOKEN": "sk-xxxxxxxxxxxxxxxx"
},
// 跳过启动时的地区检查引导
"hasCompletedOnboarding": true
}
配完执行 claude,启动横幅里能看到你的中转站域名就算成功。
想随时切换多家中转站,可以准备多份 settings.json 用脚本换,或者用社区的配置切换工具。
看到报错先别怀疑 Claude Code 本身——九成以上的问题出在 Base URL 拼写、密钥变量名、环境变量残留这三处。
| 现象 | 最可能的原因 | 怎么修 |
|---|---|---|
| 401 Unauthorized | 密钥错误/过期,或用错了变量名 | 多数中转站要求 ANTHROPIC_AUTH_TOKEN 而非 ANTHROPIC_API_KEY;检查密钥有无多余空格、令牌额度是否耗尽 |
| 404 Not Found | Base URL 路径拼错 | 结尾多一个 / 或多写 /v1,会拼成 …/v1//v1/messages。按文档写,不要自己补路径 |
| 404 且提示模型不存在 | 模型名写错或缺前缀 | 不带前缀的简写 ID 在部分中转站不识别,必须用平台文档给出的完整模型名 |
| 配了却没生效 | 旧环境变量残留 / 窗口没重开 | 用 echo $ANTHROPIC_BASE_URL 确认实际读到的值;Windows 上 setx 后必须新开窗口 |
| 仍然要求登录 Anthropic | 引导流程未跳过 / 配置文件冲突 | 在 settings.json 里加 "hasCompletedOnboarding": true,并检查 .claude.json 有无冲突配置 |
| 429 或频繁重试 | 并发/速率被限,或号池被上游限流 | 降低并发、换分组;若是逆向渠道,通常只能等或换站 |
| 连得上但不听指令 | 逆向渠道注入了隐性系统提示词 | 换官转渠道验证;同一 prompt 在官方和中转站对比行为差异 |
| 读文件只读一半 | 上下文窗口被中转站缩短 | 用超长文件测试实际可用窗口,被阉割就换站 |
排查三板斧:① echo 出来看实际读到的变量值是不是你以为的那个;
② 用 curl 直接打 /v1/messages,绕开 Claude Code 判断是链路问题还是客户端问题;
③ 临时清空所有相关环境变量,只留 settings.json,排除残留干扰。
价格只占六分之一。对 Claude Code 来说,缓存和模型真实性的权重远高于标价。
| 维度 | 为什么重要 | 怎么验证 |
|---|---|---|
| 1. Prompt Caching | 决定 Claude Code 实际账单的 50%~70% | 看文档是否明确支持 5m/1h 缓存;跑一轮长会话看用量日志里有无 cache 字段 |
| 2. 模型真实性 | 付 Opus 5 的钱拿 Haiku 的答案是最贵的坑 | 用有标准答案的高难度题(AIME/GPQA 类)固定测试,部分中转站准确率下降可达 40% |
| 3. 内部汇率 | 真正的折扣藏在汇率里,不在美元标价里 | 换算成「每百万 token 实付人民币」横向对比 |
| 4. 协议与工具调用 | Claude Code 靠 /v1/messages 和 tool calling 干活 |
用 curl 直接打 /v1/messages;跑一次真实改代码任务看工具链是否完整 |
| 5. 延迟与稳定性 | 一个任务几十轮,每轮多 300ms 就是十几秒 | 连续发 20 次同样请求,看首字延迟和失败率;优先国内节点 |
| 6. 平台可持续性 | 月抛站跑路,余额基本要不回来 | 看运营时长、公告更新频率、社群活跃度;小额滚动充值 |
/v1/messages数据安全提醒:Claude Code 会把你的源码发给上游。公司代码、密钥文件、客户数据这些内容, 技术上中转方都能看到。商业机密项目建议走官方直连或云厂商渠道, 中转站留给个人项目、开源项目和学习用途。
接入前后最常被问到的八个问题。
不需要改任何代码。中转站是一个接收 Claude Code 请求、转发给上游、再把响应原样返回的中间服务,对客户端完全透明。你只需要设置 ANTHROPIC_BASE_URL(指向中转站)和 ANTHROPIC_AUTH_TOKEN(中转站密钥)两个变量,Claude Code 就会乖乖把请求发过去。
不能随便找。普通 API 中转站主打 OpenAI 兼容格式,比的是模型数量和单价;Claude Code 有三个额外硬条件:必须支持 Anthropic 原生 /v1/messages 协议(只有 OpenAI 格式的接不上)、必须支持 Prompt Caching(否则成本翻倍)、必须保留完整的工具调用和长上下文(否则读不全文件、改一半就断)。
不行。多数中转站的模型标价直接抄官方美元价,看上去家家一样,真正的折扣藏在充值汇率里。市场参考价约 ¥7.2 兑 $1,充 ¥100 大约得 $14 额度;而部分平台内部汇率做到 ¥2.4 兑 $1,同样 ¥100 能拿到约 $41.7,相当于官方价的三分之一左右。
正确做法:把所有平台都换算成「每百万 token 实付人民币」再比。按 Claude Code 典型的输入 30%/输出 70% 负载估算,各家加权均价能差出两三倍。
值得。Claude Code 每轮请求都重复携带系统提示词、CLAUDE.md、文件树和历史对话,这部分内容在一次会话里几乎不变。开启缓存后,命中缓存的读取价通常只有写入价的十分之一左右,落到真实账单上能降低约 50%~70%。
所以会出现反直觉的情况:标价一折但不支持缓存的逆向渠道,实际用起来可能比标价三折但支持缓存的官转还贵。
401 是鉴权问题:优先检查是不是用错了变量名——多数中转站要求 ANTHROPIC_AUTH_TOKEN 而不是 ANTHROPIC_API_KEY;其次是密钥复制时带了空格、令牌过期或额度耗尽;再次是旧中转站的环境变量残留覆盖了新配置。
404 是路径问题:最常见的是 Base URL 结尾多了斜杠或多写了 /v1,导致拼成 …/v1//v1/messages;其次是把网站面板地址当成了接口地址;还有一种是模型名写错或缺前缀。
主力选官转:价格约官方三到七折,行为与官方一致,支持缓存,稳定性高。逆向号池能低到一两折,但普遍不支持缓存、可能注入隐性系统提示词让模型"不听话",且 Anthropic 一更新协议就整体失效,只适合能容忍随时断流的试验任务。Max 拼车按人头月付、额度大,但有设备数限制,同车有人乱用会拖累全车。
三个办法:一是用有标准答案的高难度题库(AIME、GPQA 这类)固定测试,对比官方与中转站的正确率——部分中转站的准确率下降幅度能达到 40%;二是直接问模型自己的标识和训练数据截止日期,看回答是否自洽;三是在 Claude Code 里跑同一个真实重构任务,观察工具调用次数、上下文保持能力和代码质量有没有明显退化。
要分级看待。Claude Code 会把你打开的文件内容发给上游,技术上中转方都能看到。个人项目、开源项目、学习用途,用口碑好的官转站问题不大;但公司核心代码、密钥文件、客户数据这类内容,建议走官方直连或云厂商渠道。另外无论用哪家,都不要让 Claude Code 读取含有密码、私钥、证书的文件。