惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

IT之家
IT之家
Recent Announcements
Recent Announcements
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
The GitHub Blog
The GitHub Blog
MyScale Blog
MyScale Blog
爱范儿
爱范儿
GbyAI
GbyAI
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
美团技术团队
Y
Y Combinator Blog
博客园 - 叶小钗
Apple Machine Learning Research
Apple Machine Learning Research
Martin Fowler
Martin Fowler
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
罗磊的独立博客
M
MIT News - Artificial intelligence
博客园 - Franky
V
Visual Studio Blog
I
InfoQ
V
V2EX
Hugging Face - Blog
Hugging Face - Blog
腾讯CDC
博客园 - 司徒正美
L
LangChain Blog

Go 编程语言

WorkBuddy + 企业微信 有人用过吗? - V2EX 业务系统开发语言从 PHP / Python 转向 Go 如何实现数据的存储 - V2EX [2026 最新] Go 1.27 泛型方法完全解读 - V2EX Go 后台接入 SSO 后,本地用户表应该怎么退? - V2EX clbtransport - 自带负载均衡的 http.Transport 简易替代 - V2EX 基于 go+react 开发的一款可私有化部署、任务驱动的代码托管平台 iForge - V2EX 分享一个还在 RC 阶段的项目:把 C 编译成不依赖 cgo 的 Go package - V2EX [工业边缘网关] EdgeX 更新啦,增加了 MCP,可以被 AI 接管了,可以让 AI 控制物理世界啦 [工业边缘网关] EdgeX 更新啦 上线了官网 顺便更新版本 v0.10.0 有了 Agent,后台脚手架是该退场,还是变成约束层? 构建时自动注入版本号:从 Git tag 到 Go 可执行文件 [边缘计算] 想借助 AI 来开发 边缘网关接入 AI 解决设备通信 不知道有没有需求 [Go]工业边缘计算网关 edgex 业余时间独立开发 持续更新半年咯 求个 star eget:不用等中央仓库,直接安装 GitHub 和任意下载站的工具 gookit/gcli v3.8:新增支持共享选项、文档生成和参数重排 V2EX 我开源了一款极简的 P2P 文件传输与 VPN 工具 (Win/Mac/ Linux /Android) gookit/gcli v3.5.0 发布 - 简单易用、功能丰富的 Go 命令行应用与工具库 用 Go gRPC 信令对接 Android WebRTC:大家一般怎么划分网关和客户端边界? 在服务端用 Pion + FFmpeg + RNN 做 WebRTC 通话降噪,值得吗? 这两种 lint 报错场景, v 友们一般怎么处理 tikrok 的部分来时路 tikrok 第 7 代微服务重构: Golang 微服务 grpc 接口与服务实现隔离方案 写了个 Go 库:在 TCP 应用协议开始前做认证,也支持端口敲门 Tikrok v6.0 新的生产级架构,成本不变,但是部署复杂略有增加 go 打包的二进制程序怎么反编译 [边缘计算开源] 工业数据采集网关 版本更新 用 golang 写了,一套面向个人音乐资产的本地优先音乐系统 做了个 Go 的 MCP Server 框架,一行代码把 Gin API 接入 AI 写了个 Go 库解决 LLM 流式输出断线重连的问题
强兼 Claude Code:左 DeepSeek V4,右 Kimi K3
menfrexu · 2026-07-21 · via Go 编程语言

Claude Code 的终端 UX 没什么好争的,行业天花板。但用它接 DeepSeek , 问题就来了——Claude Code 的上下文压缩围绕 Anthropic 的 cache_control API 设计,System Prompt 被重写、消息中间插入摘要,前缀断裂,缓存命中率直线下降。

DeepSeek 的前缀匹配定价大家应该都清楚:

  • 缓存命中:0.025–0.05 元/百万 token
  • 缓存未命中:3–6 元/百万 token
  • 价差:最高 120 倍

架构不对,同一个任务账单能差出几倍。

有一些专门为 DeepSeek 缓存优化的 Agent ,缓存做得不错。 但它们往往没有对标 Claude Code 的交互体验,也不在 .claude/ 生态兼容上投入。 从 Claude Code 切过去,skills 、hooks 、MCP 全得重配一遍。

反过来,兼容 Claude Code 的 Agent ,缓存策略又没为 DeepSeek 优化过。

Waveloom 特别在意这三件事的交集:

Claude Code 级别的 TUI 交互

  • DeepSeek 缓存命中 95% 以上
  • .claude/ 生态完整兼容( skills / hooks / MCP / plugins )

如果你也觉得这三件事缺一不可,Waveloom 可能是目前最对口的终端 Agent 。


DeepSeek 缓存优化

不是调了几个参数,是架构层面为前缀稳定性全链路设计:

  • 不可变 System Prompt — messages[0] 整个会话期间 0 字节变化
  • 追加式消息历史 — 新消息只追加到末尾,从不插入或重写
  • 四级水位线原地压缩 — Snip → Prune → Summarize → Hard Limit 。 关键不变量:已压缩的字节序列永不变化,前缀缓存持续命中
  • 实测日常开发缓存命中率 95–99%

其他 Agent 也可以在 DeepSeek 上做缓存优化。Waveloom 选择了另一个方向: 把缓存做到这个程度的同时,保留 Claude Code 级别的 UX 和生态兼容。 这个组合市面上不多见。

Claude Code 兼容(迁移零成本)

我们在这个方向上投入了不少精力:

  • .claude/skills/ SKILL.md → 直接可用,9 个 frontmatter 字段完整支持($ARGUMENTS`、`paths`、`` !`cmd` `` 动态注入、`$ 转义等)
  • .claude/plugins/ 已安装插件 → 自动发现加载
  • .claude.json MCP 配置 → 直接兼容,SSE + Streamable HTTP 双传输
  • .claude/settings.json hooks 配置 → PreToolUse / PostToolUse 等 5 种事件类型 + permission_mode 字段完整兼容,~/.claude/hooks/ 下的脚本直接复用
  • TUI 体验对标 Claude Code:流式推理语法高亮、rich diff 、@ 模糊文件选择器、/ 命令面板、权限确认对话框、明暗/色盲主题切换、中英双语界面、Shift+Tab 进出 Plan Mode

说人话:之前用 Claude Code 的,把 provider 切成 DeepSeek V4 ,skills / hooks / MCP / plugins 配置不用动,体验不会有断层。


多 Provider

  • DeepSeek V4 (主力) — 缓存优化最到位。/model 切 pro / flash ,/provider 随时换
  • Kimi K3 (尝鲜)/provider kimi 一键切换,kimi-k3 已适配,thinking 推理流式输出完整支持
  • OpenAI — 完整兼容

Claude Code 也能接 K3 API ,但 Claude Code 的上下文策略围绕 Anthropic 设计,接第三方模型核心能力打折扣。Waveloom 反过来——先为 DeepSeek 优化,同时兼容 Claude Code 生态,K3 作为多 Provider 的自然延伸。


其他亮点

  • 14 个内置工具( read / write / edit / bash / web_search / web_fetch / agent / …)
  • Subagent 系统:Fork 热启动继承上下文 + Cold 冷启动(代码评审 / 对抗验证 / 只读探索)
  • Plan Mode:先规划后执行,Guard 强制写保护
  • 会话持久化:waveloom --continue 恢复关闭前完整上下文
  • Checkpoint / Rewind:回退到任意历史消息,文件状态完整恢复
  • Advisor Mode:flash 处理日常任务,pro 自动切入 Plan Mode 和 Code Review
  • 后台任务管理 + 跨 turn 通知注入
  • 完整中英双语 UI + i18n

Waveloom Demo

技术栈:Go 1.25 + Bubble Tea v2 + Glamour + Lipgloss ,单二进制 ~20MB ,零运行时依赖(不需要 Node.js / Python 虚拟环境)。

当前 v0.2.0-beta.2 ,两百多个 commit 。日常用它开发它自己,核心循环、压缩引擎、权限管线已经比较稳了,但边缘场景仍有粗糙边角。


DeepSeek 用户如果被缓存命中率折磨过,欢迎试试。代码不经过第三方服务器,自备 API Key 。也欢迎拍砖 🙏