惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

罗磊的独立博客
小众软件
小众软件
The Cloudflare Blog
博客园 - 【当耐特】
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
酷 壳 – CoolShell
酷 壳 – CoolShell
WordPress大学
WordPress大学
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
V
Visual Studio Blog
量子位
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
美团技术团队
S
SegmentFault 最新的问题
宝玉的分享
宝玉的分享
博客园 - 叶小钗
月光博客
月光博客
Apple Machine Learning Research
Apple Machine Learning Research
T
Tailwind CSS Blog
博客园 - 聂微东
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
J
Java Code Geeks
Y
Y Combinator Blog
D
Docker
Microsoft Azure Blog
Microsoft Azure Blog

博客园 - PanPan003

AI coding - rewind、undo 撤销操作 如何省token? - 项目 知识 固化 如何省token?--- RTK ,input 数据压缩 如何省token?--- ignore文件 如何省token?--- token 用量统计 如何省token? - 何时开启新session? 如何省token? - 更便宜的模型 处理低风险任务 如何省token?-- 如何提问?避免直接粘贴 大段文件 如何省token?- Plan ,任务拆分,从小模型开始 如何省token?-rewind(todo) 如何省token?- handoff (todo) Skill - superpowers skill - mattpocock OpenCode 安装 claude code 安装 npm config AI - coding - links/summary SSH 本地端口转发 --- VM中ubuntu service 可被 Windows 访问 内网穿透 - devtunnel Linux 虚拟机 反向代理 - 到宿主机 - decimal, double在 c#中的区别 python environment settings xUnit Theory: Working With InlineData, MemberData, ClassData docker network - container networking KEDA — Kubernetes Based Event Driven Auto scaling(转载) rabbit MQ —— ha-sync-mode. message 同步/ 丢失 in new pods rabbit MQ —— ha-mode, message 同步策列:所有nodes or one nodes 博文阅读密码验证 - 博客园 Kubernetes hpa container scale up/ down 原理 in kubernetes
如何省token? - compact,压缩上下文
PanPan003 · 2026-08-05 · via 博客园 - PanPan003

Claude Code 省 Token 终极指南:同样干活,3k 和 30k 的差距藏在这些细节里-CSDN博客

Claude Code Token 烧得太快?这8个方案帮你立省90%!前言 token越来越贵了,而且高等级模型消耗的 - 掘金

1. /compact

/compact 到底做了什么?

一句话:/compact 把你的整个对话历史压缩成一份精简摘要,然后用这份摘要替换原来的对话,作为新的起点继续工作。

效果有多明显?一个 15 万 Token 的对话,compact 后通常只剩 3 万到 5 万 Token。压缩率在 60% 到 80% 之间。

长对话


摘要提炼


短上下文

Claude Code 用了一天之后响应越来越慢、/cost 里 input 越来越高,不是 Claude 变笨,是 session 历史越堆越长。每一轮对话都要把从 session 开始到现在的所有消息作为 input 重新发一次。叠加前面讲过的 5 分钟 cache 过期,长时间挂着的 session 既贵又慢。

两个续命命令:

/compact:读完整段历史,写成一份摘要替换原来的消息(适合"想继续当前任务")

/clear:完全重置(适合"开新任务")

/clear 是免费的,没什么好说的。关键是 /compact,别当成无脑的"清爽一下"按钮来用。

compact 不是免费操作:Claude 要读完整段历史再写一份总结,这一步本身就要消耗一笔 output(output 单价还比 input 贵)。之后这份摘要要被后续轮次重复利用够多次,前面多付的这笔钱才摊得回来。如果你 compact 完下一秒就切到完全无关的话题,等于白白多付一次费用,还不如直接 /clear。

比较划算的 compact 时机:

历史已经很大(/context 占用明显、响应变慢),再带着它走每轮都在烧钱

当前任务要进入下一阶段,但还想保留前面的结论。比如做完方案调研要进实现、做完实现要进联调,前面的结论摘要一下继续用

compact 后还要连续对话多轮,轮数越多越能摊薄 compact 本身的成本

反过来,这些情况别 compact:

短时间内离开一下(去倒水、开个短会),cache 没过期前历史还能复用

彻底换主题 / 开全新任务 , 直接 /clear,不要 compact

每做完一两轮就 compact 一次 , 预付成本根本摊不回来

一句话:/compact 和 plan mode 一样,是工具不是习惯,别滥用。

上下文使用率Claude 的表现
0% - 50% 正常水平
50% - 70% 开始出现细节遗漏
70% - 85% 明显忘记早期指令
85% 以上 频繁出错,方向偏离

高手的做法是:在上下文使用到 50% 到 60% 时,主动跑一次 /compact。 就像开车不等油灯亮了才去加油,而是看到剩半箱就加。

进阶用法:带指令压缩

这是 /compact 最强大的地方。你可以告诉 Claude,压缩时重点保留什么。

/compact 不是一个出了问题才用的急救命令。它是一个应该融入日常工作流的习惯。

就像程序员经常保存文件、经常提交代码一样,经常 compact 你的上下文,是一个好习惯。

推荐的节奏:每完成一个小任务,compact 一次。每工作 30 分钟,检查一次上下文使用率。上下文超过 50%,主动 compact。

保留:

✔ 架构决定

✔ Bug结论

✔ 待办事项

删除:

✘ 大量代码讨论

✘ 调试过程

✘ 中间推理

2. 长会话在 20~30 回合主动执行 /compact

当前有 4 个会话超过 20 回合,且都没有压缩点。尤其是 45 回合会话,后续每次交互都可能重复携带早期上下文。

建议在以下时机压缩:

  • 完成一个 ticket 后
  • 需求边界发生重大变化后
  • 开始修改代码前
  • 对话达到约 20~30 回合时

压缩摘要应保留:目标、已确认决策、改动文件、测试结果、当前阻塞点和下一步。