惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

V
Visual Studio Blog
D
DataBreaches.Net
博客园 - 三生石上(FineUI控件)
博客园_首页
T
Tailwind CSS Blog
美团技术团队
Hugging Face - Blog
Hugging Face - Blog
博客园 - 叶小钗
大猫的无限游戏
大猫的无限游戏
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
云风的 BLOG
云风的 BLOG
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
博客园 - 聂微东
S
SegmentFault 最新的问题
小众软件
小众软件
酷 壳 – CoolShell
酷 壳 – CoolShell
N
Netflix TechBlog - Medium
Jina AI
Jina AI
WordPress大学
WordPress大学
U
Unit 42
J
Java Code Geeks
Blog — PlanetScale
Blog — PlanetScale
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
The Cloudflare Blog

程序员

V2EX 看到讨论"跨域"的帖子,那个她好像回来了 codex 今天真的是不稳定呀。 火山方舟 Coding Plan 慎买 刚问了大家 openclaw 和 hermes 在什么机器上面玩,求推荐一个机器 GPT-image-2 生成 AI 图片防伪有感 codex pro 5 小时限制已经严重缩水 逆天 Antigravity 动态 JSON 序列化对强类型语言很难吗? 自建了 GPT Coding Plan,遇到了定价问题,请教大家 大家都是在什么设备上玩 openclaw 以及 hermes 的呀? 软考还有一个月就考试了,你们学习了吗? 大伙用 AI 会考虑在 user scope 的 CLAUDE.md/AGENTS.md 里交代 AI 说中文吗 我发现程序员这个群体很大部分其实挺抠的 最近使用 cc 总会莫名其妙的返工, codex 不会 目前体验最好的远程 vibe 工具 想知道大佬们抓包遇到 ssl pinning 都是咋优雅的 解决的? 工业软件的大佬们是怎么 vibe coding 的 最近 chrome 是不是有 bug 啊,一搜索就卡住 分布式异步系统在 vibe coding 下的困境 PHP Native AOT 编译器,支持将 PHP 代码编译为可执行文件,运算性能提高 150 倍 没想到 2026 年,还要浪费大量时间在跨域问题上 DeepSeek V4 这周会出吗? 中转站正式试营 欢迎试用 不掺不假 小米 mimo 升级 v2.5,并且重置了额度 Jenkins, SCM 轮询完全不工作是啥问题啊 赛博斗蛐蛐, AI 模型的简单对比(白嫖版) 使用中转站要擦亮眼睛!不说别的,倍率计算 充值好乱。 买了火山的 Coding Plan 测试得出计费模式 给我的 AI 生成了简历和状态卡, 大家帮忙看下 Ta 能找到啥样的
AI 中转站避坑指南:立刻停用"无缓存"中转,钱烧得比正常快 4...
l534891619 · 2026-04-28 · via 程序员

最近在评测一些 Claude 中转站,发现一个大坑,写出来给大家避一避。
先说结论:选中转站,必须确认它真正支持提示词缓存。不支持的、或者用"假缓存"的,单价再便宜也是陷阱。
为什么这是个坑?
Claude 官方接口有个特性叫提示词缓存:把长系统提示词、长上下文缓存住,5 分钟内复用,缓存读取价格只有正常输入的十分之一( Sonnet 是每百万 token 0.3 美元 vs 3 美元)。
写入缓存本身比正常输入略贵(每百万 token 3.75 美元),但只要后续命中,平摊下来非常划算。
为什么有些中转站会一直在写缓存?
我研究了一下,主要有三种情况:
1:号池不稳定,频繁切换账号。每换一个账号,缓存就重置一次,等于永远在重新写入。
2:Kiro 逆向渠道本身就没有缓存。市面上你看到的所谓"Kiro 逆向"都是假缓存,Kiro 没有返回缓存读写信息。
3:中转站自己写的假缓存代码计费有问题。前端账单页面给你显示有缓存读写,实际计费逻辑是错的
真实账单对比
我手头两个站的数据:
A 站(无缓存,每次都在写):
https://i.imgur.com/laIWTDh.png
6 次请求,每次缓存写入约 6 万 token
单次成本 0.11 到 0.13 美元
总计约 0.73 美元
B 站(真缓存):
https://i.imgur.com/jnqQSsG.png
第一次写入 6 万 token ,后续全部命中缓存读
缓存读 6 万 token 的成本约 0.018 美元
4 次请求总计约 0.16 美元
同样是分组倍率 0.5x ,同样模型( Sonnet 4.6 ),同样上下文规模,成本差了 4 倍以上。请求次数越多、对话越长,差距会被指数放大。
怎么自查?
打开你的中转站账单页,看每条记录的 token 明细:
一直显示几万、几十万缓存写入,几乎不出现缓存读 → 有问题,跑路
第一次写入后,后续大量出现缓存读、写入只有几百 → 正常
建议
充值前先小额测试,连续发几条请求,看缓存读是否生效
如果发现一直在写缓存不读,立刻停用,能退款就退款
便宜的单价 × 永远在写入的"假缓存" = 比官方还贵。别被"分组倍率 0.1x"骗了。