惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

云风的 BLOG
云风的 BLOG
M
MIT News - Artificial intelligence
Recent Announcements
Recent Announcements
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
Stack Overflow Blog
Stack Overflow Blog
J
Java Code Geeks
Microsoft Azure Blog
Microsoft Azure Blog
罗磊的独立博客
博客园 - 【当耐特】
H
Help Net Security
腾讯CDC
大猫的无限游戏
大猫的无限游戏
GbyAI
GbyAI
Last Week in AI
Last Week in AI
Jina AI
Jina AI
博客园 - 聂微东
Blog — PlanetScale
Blog — PlanetScale
A
About on SuperTechFans
Apple Machine Learning Research
Apple Machine Learning Research
P
Proofpoint News Feed
Y
Y Combinator Blog
C
Check Point Blog
博客园 - 司徒正美
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知

博客园_首页

Linux实操--组管理、权限管理和定时任务 Java + EasyExcel 实现单个接口导出多个Excel Mem0 源码解析系列(二):提示词工程的深度剖析 Openclaw TaskFlow究竟是什么?和普通Skill技能有什么区别 博文阅读密码验证 - 博客园 嘉立创开源:应该是全网MicroPython教程最多的开发板 Hermes Agent 集成实践:从协议到生产 2026年AI编程工具横评:Cursor、Codex、Claude Code、Zed、Windsurf Java程序员必看的RAG入门教程 2026 AI效率神器:Superpowers + Claude Code 保姆级教程 本地大模型部署全攻略:从 0 到 1 玩转 Ollama 【从0到1构建一个ClaudeAgent】内存管理-上下文压缩 .NET 高级开发 | 设计、实现一个事件总线框架 电子小白入门之NE555 3. WorkBuddy:隐藏玩法,一键召唤专家,让 AI 以"专家身份"给你干活 和AI一起搞事情#3:Claude Teammate 游戏开发翻车实录 【OpenClaw】通过 Nanobot 源码学习架构---(7)Memory C# .NET 周刊|2026年3月3期 我在 Debian 11 上把 K8s 单机搭起来了,过程没你想的那么顺(/opt 目录版) 深度学习进阶(七)Data-efficient Image Transformer CLI+Skill搭建浏览器AI自动化框架,告别一切重复枯燥任务 告别Token账单无底洞:OpenClaw本地部署,重塑企业数据主权的唯一解 FastAPI+Vue:文件分片上传+秒传+断点续传,这坑我帮你踩平了! SBTI 爆火后,我做了个程序员版的 CBTI。。已开源 + 附开发过程 多模态检索开始进入工程期:用 Sentence Transformers 搭建可落地的 Multimodal RAG 100多行代码实现一个最简单的Agent(用ReAct) Claude Code 通关手册(八):推荐 5 个 Hooks,代码质量提升 3 倍 老板:“有人截图了!”。安全部门:“收到,马上查暗水印!” - why技术 技术之外,皆是人间 C#/.NET/.NET Core技术前沿周刊 | 第 69 期(2026年4.01-4.12)
过去三个月对我帮助最大的一个 skill:grill-me
guangzan · 2026-06-24 · via 博客园_首页

我一直在好几个真实项目里用 Claude Code、Cursor 这类 AI 编码代理。过去三个月,模型确实在不断变强,但对我帮助最大的反而是 /grill-me 这个 skill。它会在你动手之前,不断拷问你,帮你省掉很多写一版、再改一版的循环。

为什么需要「被拷问」?

平时的用法是我们把需求丢给 AI:描述功能、举例子、列边界情况。AI 点头答应,写起来才发现它根本没理解——漏了业务约束、跟现有架构对不上,或者把复杂度想简单了。然后就开始来回改,token 和时间都烧掉了。

/grill-me 把方向反过来了:AI 来提问,沿着决策树一个分支一个分支往下走,直到双方对计划有共识。核心指令就这几行:

---
name: grilling
description: Interview the user relentlessly about a plan or design. Use when the user wants to stress-test a plan before building, or uses any 'grill' trigger phrases.
---

Interview me relentlessly about every aspect of this plan until we reach a shared understanding. Walk down each branch of the design tree, resolving dependencies between decisions one-by-one. For each question, provide your recommended answer.

Ask the questions one at a time, waiting for feedback on each question before continuing. Asking multiple questions at once is bewildering.

If a question can be answered by exploring the codebase, explore the codebase instead.

它逼你把那些没说出口的假设摊开,风险也会提前冒出来。

快速上手

在项目目录运行:

npx skills add https://github.com/mattpocock/skills --skill grill-me

然后在 coding agent 里输入 /grill-me 加上你的初步计划。

真实项目里怎么用

用法很简单:/grill-me 加上你的需求描述。注意,代理不会对着空白文档连环发问——它会先读代码库,边探索边提问。我喜欢配合 Cursor 的 Plan Mode 使用,先通过 /grill-me 构建一个计划然后再实现计划。

下面两个例子来自同一个多租户中后台项目,一个做新功能,一个改老逻辑。

新功能:批量导入

最初想法:加个批量导入,支持 Excel 和 API。
直接扔给 AI,第一版就翻车——审计日志没考虑、事务一致性没想清楚、配额和大文件处理也漏了。

换成 /grill-me 后,代理先翻了现有导入模块和权限模型,然后才开口:

「批量导入是谁触发的?手动上传、定时任务,还是第三方 webhook?」答完接着问:「成功和失败怎么通知?要不要异步?失败重试几次?」每答一个,它会给推荐方案,并确认依赖,比如「这会动到现有权限模型吗?」

几轮下来,功能边界清楚了,跟领域模型的冲突也提前暴露(比如 materialization cascade)。最终实现基本一次过。

已有功能迭代:订单支持部分取消

这次是改一条老链路:已发货订单原先只能整单取消,产品要求支持部分取消。

代理没有先写方案。它顺着 OrderService 的状态机往下追,发现取消会触发退款、库存回滚和仓库 webhook;又追到 PromoEngine,看到满减是按整单算的。然后才开始问:

  • 部分取消后,满减要不要重算?代码里三种算法,注释只写了『按运营规则』——你定哪一种?
  • 混合支付(余额 + 微信)时,退款按什么比例拆?现有 RefundService 只处理整单,没有部分退的路径。
  • 仓库 webhook 是 fire-and-forget,没有幂等键。部分取消如果重试,会不会重复通知?

这些问题里,有些能从代码推断出推荐答案;有些连开发都说不准!历史上运营改过口径,文档没更新。这种场景只能拉业务确认,有时候你自己做不了决定,AI 更替你做不了决定,这种情况下的决定往往是错的。grill-me 的价值恰恰是把它们提前拎出来,而不是写完了才发现。

如果直接改,我大概率只会动 OrderService 的状态判断,漏掉 bundle 重算、混合支付拆账和 webhook 幂等。上线后就是「取消成功但退款不对」或者「仓库收到两次取消通知」这类 bug。grill-me 逼我把这些分支走一遍,该写 ADR 的写 ADR,该找运营确认的当场记下来。改完跑回归,没有冒出新的边角问题。

修遗留 bug

我仍然这么用!先 grill-me + plan mode 代理先复现代码路径,再问你影响范围和回归点,少踩修好一个冒出三个的坑。

流程长什么样

flowchart TD A["Idea / 初步计划"] --> B["grill-me + 需求描述"] B --> C{"已有代码库?"} C -->|是| D["先读代码库,可选 grill-with-docs"] C -->|否| E["从领域约束出发"] D --> F["沿决策树逐分支探索"] E --> F F --> G["一次只问一个问题"] G --> H{"问题可由 codebase 回答?"} H -->|是| I["AI 探索代码上下文并给出推荐"] H -->|否| J{"开发或 AI 能拍板?"} J -->|是| K["用户回答 + AI 推荐方案"] J -->|否| L["记录待确认项,拉业务确认"] I --> M["确认该分支决策"] K --> M L --> M M --> N{"决策树还有未收敛分支?"} N -->|是| F N -->|否| O["达成共享理解"] O --> P["更新 CONTEXT.md 或 ADR"] P --> Q["Plan Mode 制定实现计划"] Q --> R["tdd 或 implement 等后续 skill"] R --> S["回归验证"] S --> T["持续优化或新 idea"] T --> A

对齐放在实现前面,形成一个闭环。如果项目已经有代码库,可以用 grill-with-docs,边问边把 ubiquitous language 和 ADR 建起来。

为什么这三个月它一直在用

最大的感受是少返工。很多误解在写代码之前就暴露了,不用等到实现阶段才发现。对话本身也能沉淀成文档,后面查起来方便。而且这个 skill 不绑特定模型,换代理、团队共享都省事。它逼我自己想清楚,而不是把坑留给 AI 去填。用久了,这点比省下来的 token 更值。

Matt Pocock 的 skills 仓库整体偏向真实工程,不是 vibe coding。grill-me 核心就几行,但能跟别的 skill 组合着用,这点我挺喜欢。

grill-me 和 superpowers 那些工具有什么不同

我试过不少 AI 增强工具,包括各种 superpowers 插件——预设模板多、自动化流程全、领域知识也齐。grill-me 不一样,它不替你定方案,而是把你的意图和约束挖出来。复杂、定制化的项目里,这点特别管用。

superpowers 适合快速套模式,比如某个框架的最佳实践。grill-me 更像元技能:先想清楚问题,再决定用什么模式。我自己加上 frontend-design 或 review 这几个 skill 就够用了,不用堆一堆配置。

跟仅仅使用 Plan Mode 比,grill-me 更主动。它不会一次吐一篇长计划,而是一个问题一个问题地问,确认完再往下走。

有什么不好?

我发现有些模型追问过细,这也并没有什么不好。

总结

如果你也被 AI 编码里的反复迭代搞烦了,可以试试,它会让你想得更清楚。这三个月它帮我绕了不少弯路,包括迭代核心业务代码也让我更有信心。

试试吧,有奇效!

相关链接