惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

爱范儿
爱范儿
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
G
GRAHAM CLULEY
www.infosecurity-magazine.com
www.infosecurity-magazine.com
V2EX - 技术
V2EX - 技术
The Last Watchdog
The Last Watchdog
S
Secure Thoughts
Webroot Blog
Webroot Blog
PCI Perspectives
PCI Perspectives
L
LINUX DO - 最新话题
Hacker News: Ask HN
Hacker News: Ask HN
N
News and Events Feed by Topic
H
Heimdal Security Blog
H
Help Net Security
T
The Blog of Author Tim Ferriss
P
Proofpoint News Feed
The GitHub Blog
The GitHub Blog
Jina AI
Jina AI
Recent Commits to openclaw:main
Recent Commits to openclaw:main
F
Full Disclosure
小众软件
小众软件
S
Securelist
罗磊的独立博客
NISL@THU
NISL@THU
D
Darknet – Hacking Tools, Hacker News & Cyber Security
C
Cisco Blogs
云风的 BLOG
云风的 BLOG
C
CERT Recently Published Vulnerability Notes
Cisco Talos Blog
Cisco Talos Blog
Know Your Adversary
Know Your Adversary
S
Schneier on Security
D
DataBreaches.Net
M
MIT News - Artificial intelligence
V
Vulnerabilities – Threatpost
N
News and Events Feed by Topic
有赞技术团队
有赞技术团队
F
Fortinet All Blogs
T
Tenable Blog
The Register - Security
The Register - Security
C
Check Point Blog
AWS News Blog
AWS News Blog
Cloudbric
Cloudbric
C
CXSECURITY Database RSS Feed - CXSecurity.com
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
C
Cyber Attacks, Cyber Crime and Cyber Security
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
Google Online Security Blog
Google Online Security Blog
博客园 - 叶小钗
Hacker News - Newest:
Hacker News - Newest: "LLM"
博客园 - 司徒正美

暗无天日

读:AI Agent 安全日志——从可见性与隐私的两难说起 - 暗无天日 读:AI Agent 生产化——一份从原型到上线的速查清单 - 暗无天日 AI写作的语言指纹——如何让文字不那么像机器 - 暗无天日 读:50 条 Claude Code 技巧——一个工程经理的六个月使用心得 读:AI 辅助开发为什么让 E2E 测试更有价值 - 暗无天日 读:在Emacs中使用Claude Code(Spacemacs适配版) - 暗无天日 Claude Code 背后的工程哲学——读 Agent Harness Engineering 读:Agent Harness Engineering——AI 智能体不只是模型,还有套件 - 暗无天日 browser-harness:让 AI 直接接管你的浏览器 - 暗无天日 读:Security-First CI/CD —— DevSecOps 自动化实践指南 TIL: 数字小键盘的小数点陷阱与行内算术求值 - 暗无天日 读:Immutability 不是万能药,它是一种权衡 - 暗无天日 Conducty:给 Claude Code 加上项目记忆和并行执行能力 - 暗无天日 读 — GitHub Trending 里的 Claude Code 技能包 读 — Prompt Caching 省钱指南 TIL: Emacs 中那些跟鼠标配合的冷门快捷键 - 暗无天日 读:Anvil——把 Emacs 变成 AI 的工具服务器 读:Emacs 代码折叠终极指南 - 暗无天日 读:Clojure 搭车客指南 - 暗无天日 git推送失败后恢复仓库损坏的完整记录 - 暗无天日 用 Org Babel 写 Literate 博文:扩展执行 + 定制导出 proced:Emacs 内置的进程查看器 - 暗无天日 从 proced 定制中学到的 Elisp 模式 读:让 Emacs proced 在 macOS 上显示 CPU 和内存 异步编程的函数着色税 - 暗无天日 链式调用的代价:JavaScript 和 Clojure 的共同教训 - 暗无天日 hyperfine:命令行基准测试工具 - 暗无天日 管道中的变量去哪了?——子 shell 作用域陷阱 - 暗无天日 开源包装器的信任陷阱:四个危险信号 - 暗无天日 程序员愿意为 AI 写文档,却不愿为同事写 - 暗无天日 mktemp: Shell 脚本中临时文件的安全陷阱与最佳实践 - 暗无天日 WSL9x —— 在 Windows 9x 里跑 Linux 内核 6.19 用 ox.el 做你想做的事 —— org-export 高级编程指南 读:Hot-wiring the Lisp Machine —— 用纯 Elisp 构建零依赖的 Org 静态站点生成器 Elisp 性能优化的六个实战教训 - 暗无天日 fcitx5 下 Emacs 无法切换输入法的排查 - 暗无天日 ERT 测试交互命令的三种方式 - 暗无天日 SEM Assistant: 当 Elisp 守护进程遇上 LLM 用 dmsg 给 Elisp 加上结构化调试日志 用 org-habit 追踪非每日习惯 - 暗无天日 Clojure X-Men:当编程语言特性变成超能力 - 暗无天日 TIL: 用 diff-hl 在 fringe 中显示 git 变更 读:llm-test —— 用 LLM agent 驱动 Emacs 测试 TIL: AI 时代的橡皮鸭调试 - 暗无天日 fcitx 启动后键盘输入卡顿的排查 - 暗无天日 TIL: 早期网页的图片热区导航 - 暗无天日 读 Seeing the Whole System 用 Emacs 自动生成每周链接推荐 - 暗无天日 读:ASCII control characters in my terminal 读 What to learn - 暗无天日 Lisp 的括号之痛——一个愚人节玩笑揭开的老伤疤 - 暗无天日 一本书该"线性读"还是"并行读" - 暗无天日 读 How to Monetize a Blog:一篇伪装成变现指南的讽刺文 Python Mock 第三方依赖的四种策略 - 暗无天日 Emacs Lisp 热重载实用指南 - 暗无天日 Prot 的 Emacs 配置哲学 - 暗无天日 TIL: 从直播对谈中学到的三个 Emacs 技巧 - 暗无天日 TIL: 自动使用项目虚拟环境的 Python - 暗无天日 TIL: 让 Help buffer 自动获得焦点 一条命令让本地开发用上 HTTPS —— slim 工具介绍 用 fsck 检查和修复 Linux 文件系统 排查Linux进程"卡死"实战:从strace到gdb全流程 - 暗无天日 PostgreSQL 索引:从基础到你可能不知道的高级用法 - 暗无天日 用 .pdbrc 自定义 Python 调试器 ANSI 转义码的标准化现状 - 暗无天日 终端程序的潜规则 - 暗无天日 PARA Org-mode 测试配置 - 暗无天日 AI越强越辣鸡?控制论说这是必然的 - 暗无天日 AI 越强越需要你盯着——反馈循环实操指南 - 暗无天日 你的AI代理正在偷你的密钥——四种你没想到的泄露通道 - 暗无天日 LLM 在 DevOps 中的三种角色 - 暗无天日 写作风格的反建议 - 暗无天日 反驳本质复杂性——Dan Luu 论为什么《没有银弹》错了 - 暗无天日 文件充满了危险——Dan Luu 谈文件系统的可靠性陷阱 - 暗无天日 AI 时代的 PARA 方法:用 Org-mode 和 AI 打造个人知识管理系统 Linux 数据去重学习笔记 - 暗无天日 创建跨平台 ZIP 文件的隐藏陷阱:Extra Field - 暗无天日 X11 Forwarding 排障指南 - 暗无天日 IP欺骗端口扫描:当别人冒充你去扫描别人 - 暗无天日 Linux 输入栈全景解析:从硬件按键到屏幕响应 - 暗无天日 Unix 系统中那些被埋没的配置开关——以 FontConfig 为例 - 暗无天日 在Linux上限制儿童使用电脑 - 暗无天日 GIF不仅仅是一种图片格式——用GIF流做些奇怪的事 - 暗无天日 Leiningen 学习笔记:Clojure 项目构建与管理从入门到实战配置 - 暗无天日 Google SRE Book 读书笔记 - 暗无天日 yes 管道 head 发生了什么 - 暗无天日 为什么 nohup 在 crontab 中不起作用 Bash中的Indirection与Nameref - 暗无天日 Linux PAM 简介 - 暗无天日 从Linux ISO文件启动计算机 - 暗无天日 用 Bash 打造一个Screen Locker 用GitHub Actions自动构建EGO博客 - 暗无天日 blocking I/O 的作用 - 暗无天日 mobileog 手机端同步提示Error:2 No such file 的解决方法 回收 WSL2 VHDX 文件占用空间 使用 org-mode columnview 生成任务列表 - 暗无天日 Emacs 作为 MPD 客户端 - 暗无天日 移动文件路径却不破坏org file link的方法 - 暗无天日 如何合理的导出help link 成HTML - 暗无天日 笑话理解之Biology - 暗无天日
多智能体系统的两个有效模式——以及对 Claude Code 用户的启示 - 暗无天日
2026-04-26 · via 暗无天日

Cognition 公司(Devin 背后的团队)花了 10 个月测试多智能体系统,发现只有两个模式真正靠谱:

  • 代码审查环 :一个 AI 写代码,另一个 AI 审查代码。关键是审查的 AI 完全不知道写代码的过程,只看最终结果。
  • 聪明朋友 :一个便宜、快速的 AI 做大部分工作,遇到搞不定的问题时临时请一个更强的 AI 帮忙出主意。

这两个模式有一个共同原则—— 单线程写入,多线程提供智能 。谁来改代码,同一时刻只能有一个;但可以同时有多个 AI 从不同角度贡献分析和建议。多个 agent 同时往同一份代码里写东西会导致风格冲突和产品脆弱,就像多个厨师同时往一道菜里加盐,每个人都不知道别人加了多少。

Claude Code 是单 agent 工具,不是多智能体系统。但 Devin 团队的发现对 Claude Code 用户有直接的操作启示:这些模式可以转化为单 agent 的工作流策略。

单线程写入:为什么"多个 AI 一起写代码"行不通

"多 agent 并行写入"是指两个 AI 同时修改同一份代码。比如一个 AI 在改登录模块,另一个在改支付模块,但它们都碰了同一个配置文件——一个加了新字段,另一个删了旧字段,最终谁的修改覆盖谁的?更隐蔽的问题是:两个 AI 对错误处理的方式不同(一个用异常,一个用返回码),对命名风格的偏好也不同,这些 隐含决策 互相矛盾时,最终产物就变得脆弱。

这个问题的映射到 Claude Code 不是"不要同时做多件事"(Claude Code 本来就是单线程的,做不到同时做多件事),而是: 不要在一个 session 里连续做多件不同类型的事 。比如先让 Claude Code 重构代码,紧接着让它加新功能——重构过程中积累的上下文(旧的变量名、已经不存在的函数)会干扰后面加功能时的判断。session 越长,上下文越杂,Claude Code 的有效注意力越分散。遇到需要"切换思路"的时刻,开一个新 session 比在当前 session 里堆指令更有效。

模式一:代码审查环

Devin 团队的发现中最反直觉的一条:编码 agent 写完代码后,让审查 agent 用 纯净上下文 (完全不知道编码过程)来审查,效果远好于让"全知全能"的 agent 自己审查自己。平均每个 PR 抓到 2 个漏洞,其中约 58% 是严重的逻辑错误、边界遗漏或安全漏洞。

为什么纯净上下文反而更聪明?这是注意力机制的数学问题,不是经验问题。上下文越长,模型的注意力头需要覆盖的信息越多,重要细节被淹没的概率越大。编码 agent 工作了几个小时,读了仓库、跑了命令、尝试过不同方案、修复过错误——它的上下文又长又乱。审查 agent 只看到 diff,从头读代码,自己重新发现需要的信息。上下文越短,有效智能越高。

Claude Code 用户的实操方法 * :写完代码后, * 开一个新 session 来审查 。新 session 不需要知道你之前做了什么,只需要看 diff 或最终代码。

审查 prompt 示例:

请审查以下代码变更,重点关注:
1. 逻辑错误和边界遗漏
2. 安全漏洞
3. 是否有更简洁的实现方式

[粘贴 diff 或代码]

关键点:审查 agent 由于缺少上下文信息,可能会修改一些你有意为之的设计。你自己需要知道哪些审查建议是不合理的,哪些审查建议值得采纳。

模式二:聪明朋友

想象一个初级程序员做大部分日常编码工作,遇到搞不定的难题就转头问旁边的资深同事。这就是"聪明朋友"模式——便宜、快速的模型做 80% 的工作,遇到困难时临时请一个更强、更贵的模型帮忙。Devin 团队在生产环境中验证了这个架构,甚至让不同厂商的前沿模型以这种方式协作:有些模型更擅长调试,有些更擅长写测试,按能力分工而不是按难度升级。

但核心难题是 通信设计 ,有三个具体问题:

  1. 弱模型怎么知道自己不行? -- 弱模型天然倾向于低估任务难度——这跟人类的达克效应(能力不足的人高估自己)结构上非常相似。Devin 团队的方案是鼓励主模型至少调用一次聪明朋友来评估是否有遗漏的难点。
  2. 主模型该分享什么上下文? -- 实践中发现,直接把主模型的完整上下文分叉一份给聪明模型,再加上开放性问题("我该怎么做?"),效果比只分享部分上下文加具体问题更好。让聪明模型自己决定什么值得讨论。
  3. 聪明朋友该怎么回复? -- 有时候主模型没看过某个关键文件,然后问了一个涉及其文件内容的问题。聪明朋友正确的做法不是自己给出答案,而是告诉主模型"先去读那个文件,然后再来问我"。

Claude Code 用户的实操方法 :日常用 Claude Code(Sonnet)干活。遇到特定类型的难题——调试困难的问题、架构决策、复杂的性能优化——可以手动切换到更强模型(如 Opus)或者另一个 AI 工具获取"第二意见"。

切换时最重要的是 怎么描述问题 。基于 Devin 团队的经验:

  • 不要只给具体问题("这段代码为什么报错?"),给开放性问题("这个模块的整体设计有什么问题?")效果更好
  • 附上足够的上下文(相关代码、错误信息、你尝试过的方案),让对方模型自己判断重点
  • 如果对方模型反问"你看过 X 文件吗?",认真对待这个信号——它往往指向你没注意到的关键信息

局限也很明显:Claude Code 目前不支持自动升级模型。你必须手动判断"这个问题需要更强的模型",手动切换,手动把结果带回工作 session。这个"通信桥梁"目前只能由人来做。

你的角色:通信桥梁

Devin 团队总结说,所有开放问题都是通信问题——弱模型怎么学会何时升级、子 agent 怎么把发现传递给同伴、怎么在 agent 之间传输上下文而不淹没接收者。

在 Claude Code 的场景下,你就是那个通信桥梁。你负责:

  • 判断何时开新 session (代码审查环)
  • 判断何时切换更强模型 (聪明朋友)
  • 在 session 之间传递关键信息 (你从旧 session 带到新 session 的上下文)
  • 过滤 AI 的建议 (用你的完整上下文判断哪些建议值得采纳)

这个角色目前无法自动化。但 Devin 团队说得对:目标不是"一群自主行动的角色",而是"一个扩展人类品味的协调系统"。用好单 agent + 纯净上下文审查 + 聪明朋友升级,不需要等到完美的多 agent 系统出现,已经能覆盖大部分场景。