惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

G
Google Developers Blog
人人都是产品经理
人人都是产品经理
爱范儿
爱范儿
云风的 BLOG
云风的 BLOG
Last Week in AI
Last Week in AI
H
Hackread – Cybersecurity News, Data Breaches, AI and More
B
Blog
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
H
Help Net Security
B
Blog RSS Feed
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
N
Netflix TechBlog - Medium
S
SegmentFault 最新的问题
The Cloudflare Blog
I
InfoQ
美团技术团队
博客园 - 三生石上(FineUI控件)
MyScale Blog
MyScale Blog
酷 壳 – CoolShell
酷 壳 – CoolShell
博客园 - 司徒正美
L
LangChain Blog
A
About on SuperTechFans
T
The Blog of Author Tim Ferriss
Y
Y Combinator Blog

V2EX - 技术

牛逼了,我的阿里云百炼 Coding Plan Pro 莫名被永久封禁,联系客服,无法解封。寻求替代。 Antigravity 断连 Local-first 软件收录站 从 X 上搬运来的白嫖 GPT Plus 教程 阿里云百炼 Coding Plan Pro 套餐 新增当日 token 限制 大家的 Claude 弹了 kyc 嘛 现在 Google 的 Gemini 和 AI 模式降智的厉害啊 用的 TAG 家的 T, ip 跳变是否影响使用 claude 同一 apple 账户能给不同 claude 账号充值么 做了个 Go 的 MCP Server 框架,一行代码把 Gin API 接入 AI 请教各位,想回归技术,如何系统学习 Agent? OpenAI GPT-IMAGE-2 提示词合集 你是说, claude opus4.6 写代码的能力不如 gpt5.4? 关于智谱 Max 套餐要不要升级续费呢? App → CLI → App ? Github 账号被 404 了,现在没法恢复,求各位大佬指点 cursor 的次数套餐以后应该都用不了新模型了 openrouter 使用国外模型 买了咸鱼低价 Gemini pro,账号差点被盗。突然发现国内诈骗成本为零 Gemini 手机版客户端登陆总是在此国家/地区无法使用 gemini 感觉 gpt 这些低价渠道要爆了 claude code 和 codex 在 vibe coding 还有质的区别吗? 阿里 Coding Plan 一天三变, Lite 版本到期不能续费了 RAG 难以让人满意啊 2026 年了,这个世界还存在互联网精神🥹 两个账号阵亡,尼区 Claude Pro 订阅 分享下最近低价 GPT Codex 的来源(源头) OpenAI 发布 Codex 重大更新:支持自动操作电脑与长期任务自动化 使用 claude 从 0 开始开发一个校友会系统可行吗 同一个 appleid 可以给不同 chatGPT 账号订阅 plus 吗?
AI 中转站避坑指南:立刻停用"无缓存"中转,钱烧得比正常快 4...
l534891619 · 2026-04-28 · via V2EX - 技术

最近在评测一些 Claude 中转站,发现一个大坑,写出来给大家避一避。
先说结论:选中转站,必须确认它真正支持提示词缓存。不支持的、或者用"假缓存"的,单价再便宜也是陷阱。
为什么这是个坑?
Claude 官方接口有个特性叫提示词缓存:把长系统提示词、长上下文缓存住,5 分钟内复用,缓存读取价格只有正常输入的十分之一( Sonnet 是每百万 token 0.3 美元 vs 3 美元)。
写入缓存本身比正常输入略贵(每百万 token 3.75 美元),但只要后续命中,平摊下来非常划算。
为什么有些中转站会一直在写缓存?
我研究了一下,主要有三种情况:
1:号池不稳定,频繁切换账号。每换一个账号,缓存就重置一次,等于永远在重新写入。
2:Kiro 逆向渠道本身就没有缓存。市面上你看到的所谓"Kiro 逆向"都是假缓存,Kiro 没有返回缓存读写信息。
3:中转站自己写的假缓存代码计费有问题。前端账单页面给你显示有缓存读写,实际计费逻辑是错的
真实账单对比
我手头两个站的数据:
A 站(无缓存,每次都在写):
https://i.imgur.com/laIWTDh.png
6 次请求,每次缓存写入约 6 万 token
单次成本 0.11 到 0.13 美元
总计约 0.73 美元
B 站(真缓存):
https://i.imgur.com/jnqQSsG.png
第一次写入 6 万 token ,后续全部命中缓存读
缓存读 6 万 token 的成本约 0.018 美元
4 次请求总计约 0.16 美元
同样是分组倍率 0.5x ,同样模型( Sonnet 4.6 ),同样上下文规模,成本差了 4 倍以上。请求次数越多、对话越长,差距会被指数放大。
怎么自查?
打开你的中转站账单页,看每条记录的 token 明细:
一直显示几万、几十万缓存写入,几乎不出现缓存读 → 有问题,跑路
第一次写入后,后续大量出现缓存读、写入只有几百 → 正常
建议
充值前先小额测试,连续发几条请求,看缓存读是否生效
如果发现一直在写缓存不读,立刻停用,能退款就退款
便宜的单价 × 永远在写入的"假缓存" = 比官方还贵。别被"分组倍率 0.1x"骗了。