惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

有赞技术团队
有赞技术团队
MyScale Blog
MyScale Blog
Cyberwarzone
Cyberwarzone
Schneier on Security
Schneier on Security
I
Intezer
Cisco Talos Blog
Cisco Talos Blog
Cloudbric
Cloudbric
Exploit-DB.com RSS Feed
Exploit-DB.com RSS Feed
NISL@THU
NISL@THU
博客园 - Franky
F
Fortinet All Blogs
Google DeepMind News
Google DeepMind News
Jina AI
Jina AI
T
The Exploit Database - CXSecurity.com
P
Proofpoint News Feed
N
News and Events Feed by Topic
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
F
Full Disclosure
T
Troy Hunt's Blog
D
Darknet – Hacking Tools, Hacker News & Cyber Security
Project Zero
Project Zero
P
Palo Alto Networks Blog
Recorded Future
Recorded Future
美团技术团队
D
Docker
PCI Perspectives
PCI Perspectives
Microsoft Azure Blog
Microsoft Azure Blog
MongoDB | Blog
MongoDB | Blog
L
LINUX DO - 最新话题
Recent Announcements
Recent Announcements
Hacker News: Ask HN
Hacker News: Ask HN
人人都是产品经理
人人都是产品经理
月光博客
月光博客
D
DataBreaches.Net
The Hacker News
The Hacker News
爱范儿
爱范儿
V
Visual Studio Blog
Engineering at Meta
Engineering at Meta
SecWiki News
SecWiki News
cs.CV updates on arXiv.org
cs.CV updates on arXiv.org
A
About on SuperTechFans
Latest news
Latest news
GbyAI
GbyAI
T
Tor Project blog
L
LINUX DO - 热门话题
Security Latest
Security Latest
博客园 - 聂微东
Y
Y Combinator Blog
AI
AI
M
MIT News - Artificial intelligence

博客园 - iTech

7万星的AI交易框架:让大模型模拟投行多空辩论,自动做交易决策 71000颗星的AI交易团队:让大模型模拟投行分工,自动做交易决策 13400颗星的开源项目:输入一句话,AI全自动帮你做短视频 102颗星的沙盒:当AI学会自己写代码、跑测试、做部署 AI 技术日报 - 2026-05-08 29k 星的 PageIndex:不用向量数据库,靠推理就能做 RAG 每天花两小时刷信息?这个开源项目帮你全自动搞定 读源码像读小说?试了 DeepWiki 和 Zread,我再也不想裸读 GitHub 了 Matt Pocock 开源的这套 .claude 技能,为什么让工程师集体上头? Cursor Team Kit:Cursor 官方团队在用的 17 个 AI 工作流 AI 技术日报 - 2026-05-07 AI 技术日报 - 2026-05-06 AI 技术日报 - 2026-05-05 Anthropic CEO 说 12 个月内程序员要失业,我扒完他的底牌,发现事情没那么简单 把工程师的肌肉记忆装进 Claude Code,这个 4300 Star 的项目我后悔没早用 AI 技术日报 - 2026-05-04 AI 技术日报 - 2026-05-03 AI 技术日报 - 2026-05-02 六大 Agent 框架横评:谁支持 Skills?谁能自动创建 Agent?MCP 呢? Wechatsync:一个 Chrome 插件,一键把文章同步到 31 个平台 LangChain 开源了 Open SWE:Stripe、Ramp、Coinbase 内部都在造的编程 Agent Cockpit:把 Claude Code 从终端里搬出来,装进浏览器 Cursor 把自家的 AI Agent 开放了:写几行 TypeScript 就能调 Cursor 干活 AI 技术日报 - 2026-05-01 AI 写代码每次结果都不一样?Archon 用 YAML 工作流把 AI 编程变成流水线 AI 写代码比你快了,但你还是得学编程——只不过学法得换 腾讯的龙虾特工队:4 个 AI Agent 同日更新,全家桶正式成型 Agno 不做更聪明的 Agent,它要把所有 Agent 框架包进同一个操作系统 Hermes Agent 终于有了像样的 Web 界面,而且还支持远程访问 Datawhale 出了一套 29 学科知识地图,把 AI 的底牌全掀了 Hermes Agent 在聊天框里就能用的 20 种高级功能 一份 AGENTS.md 能顶一次模型升级?Augment Code 用数据说了算 NVIDIA 开源了一个「AI 沙箱」,20K Star,让 Agent 跑代码不再裸奔 60ms 冷启动、5MB 内存:腾讯开源的这个沙箱让 Docker 安全隔离像笑话 AI 技术日报 - 2026-04-30 AI 技术日报 - 2026-04-29 AI 技术日报 - 2026-04-28 Goose:Linux 基金会亲儿子,能撼动 Claude Code 和 OpenCode 吗? AI 技术日报 - 2026-04-27 AI 技术日报 - 2026-04-26 Google 把价值20美元/月的东西免费了,102K人已经抢到了 OpenClaw 和 Claude Code 网络搜索配置指南 AI 技术日报 - 2026-04-25 Anthropic 为什么遥遥领先:从 Cat Wu 专访看AI霸主的底层逻辑 Mac 本地跑大模型完全指南:你的苹果电脑就是 AI 工作站 同样 70B 参数,为什么 MoE 只激活 13B 就能打平 Dense? DeepSeek-V4 技术报告里藏着一条线:华为昇腾 NPU 已完成推理验证 DeepSeek-V4 深夜炸场:1M 上下文、384K 输出、双模型,API 定价直接卷到底 MacBook Air 跑大模型实测:Ollama、llama.cpp、LM Studio 谁才是本地推理之王? AI 技术日报 - 2026-04-24 OpenCode:Claude Code 的最佳平替 2026 开源大模型五国杀:Qwen 3.6 vs Gemma 4 vs Llama 4 vs GLM-5.1 vs DeepSeek V4 MCP 与 Skills 的你死我活:Anthropic 的 Agent 生态野心与开发者的站队困境 给 AI Agent 配搜索,国内能用的搜索 API 实测对比 AI 技术日报 - 2026-04-23 CC Switch:49K Star 的 Claude Code 登录绕过神器,还能管 Codex 和 Gemini CLI NVIDIA 开出 32 万美元年薪招 AI Agent 工程师,JD 里藏着这些信号 fast-mirror-skill 技术拆解:一个小而完整的 Claude Skill 是怎么设计的 Cursor 值 600 亿美元?马斯克这次赌的不是技术,是入口 AI 技术日报 - 2026-04-22 别再问 AI 能不能赚钱了:3 个上班族亲测有效的副业方法(2026 最新版) 10 分钟从零搞定 Hermes Agent:飞书微信双通道丝滑上线 AI 技术日报 - 2026-04-21 Anthropic 实战总结:AI Agent 的 3 种工作流模式,选错代价很大 安装 openclaw,hermes 慢的想发疯,fast-mirror-skill 来救了 Claude Routines:你下班睡觉了,Agent 还在为你干活 微信飞书里敲一个斜杠就能干活:Hermes Quick Command 到底多省事 AI 正在疯狂吃电:算力尽头是电力,谁能解这道题? AI 技术日报 - 2026-04-20 3K 行代码造一个越用越聪明的 AI Agent:GenericAgent 登顶 GitHub Trending 高德途途封神机器人半马,背后的 ABot-Claw 到底是什么 人们希望 AI 能干啥?Anthropic 调查:第一名不是赚钱,是变强 AI 时代人们在担心什么?Anthropic 的 13 条焦虑排行榜 OpenAI 官方 Agent SDK 来了:22k Star,支持 100+ 模型,Python 10 行代码上手 AI 技术日报 - 2026-04-19 OpenAgents Workspace:让 Claude Code 和 Codex 在同一个群里干活 Claude 是要干掉整个软件行业吗? Claude 官方推荐多 Agents 设计模式 多 Agent 系统的 5 种协调模式:选错了模式,再强的 Agent 也白搭 AI 技术日报 - 2026-04-18 AI 技术日报 - 2026-04-17 Better-Harness:让AI Agent自己优化自己的革命性框架 OpenClaw Workspace 完全指南:我的AI编程工作流 DeepSeek内蒙草原高薪招聘:AI时代的数字牧民梦,还是营销噱头? 2 核 2G 的阿里云 ECS 能跑 OpenClaw 吗?能,但有点折腾 AI 技术日报 - 2026-04-16 OpenCLI:一个命令行搞定 16+ 内容平台的神器 从零到精通:OpenClaw CLI 命令完全指南 AI 技术日报 - 2026-04-15 AI Agent 如何自我进化?Hermes Agent Self-Evolution 深度解析 AI 技术日报 - 2026-04-14 为什么你的飞书 Bot 总是连不上?OpenClaw Gateway 架构深度解析 OpenClaw 连接飞书的原理:Gateway、Channel 与消息流转 国内安装 Hermes Agent 踩坑全记录:从 GitHub 超时到正常跑起来的每一步 35 万 Star 的 OpenClaw:5 分钟部署你的私人 AI 助手,直连飞书 AI 技术日报 - 2026-04-13 公司用 AI 筛简历,这个开源项目让候选人用 AI 反选公司 为什么 Google ADK 可能是你下一个 Agent 框架——7 个改变游戏规则的特性 Microsoft Agent Framework 深度解析:架构设计与实战落地 AI 技术日报 - 2026-04-11
橙色手册:LLM Agent 循环工程的完整实践指南
iTech · 2026-06-19 · via 博客园 - iTech

橙色手册:LLM Agent 循环工程的完整实践指南

当我们谈论 Agent 时,大多数人关注的是模型能力、工具调用、RAG 检索——但很少有人深入讨论那个最核心的东西:思考循环(Thinking Loop)

Loop Engineering Orange Book(循环工程橙色手册)正是为了填补这个空白而生。这不是一本理论书,而是无数 Agent 开发者踩坑踩出来的实战手册。

什么是 Loop Engineering?

简单来说,Loop Engineering 就是设计、调试和优化 Agent 思考循环的工程学科

一个典型的 Agent 循环是这样的:
1. 观察(Observe):收集当前状态和环境信息
2. 思考(Think):分析情况,制定计划
3. 行动(Act):执行工具调用或代码
4. 反思(Reflect):评估结果,调整策略
5. → 回到第 1 步

这个循环听起来简单,但真正跑起来时,你会遇到各种各样的问题:死循环、无限递归、工具滥用、方向跑偏、状态爆炸...

Loop Engineering 就是解决这些问题的方法论。

循环设计的核心原则

1. 每个循环必须有明确的进展度量

反模式:循环跑了 10 次,你完全不知道它在干嘛,也不知道有没有接近目标。

最佳实践:每个循环都应该产出可量化的进展指标。

# ❌ 坏的循环设计
loop:
  while: true
  steps: [think, act]

# ✅ 好的循环设计
loop:
  max_iterations: 15
  progress_metric: "任务完成百分比"
  exit_conditions:
    - "任务完成度 >= 100%"
    - "连续3次无实质进展"
    - "达到最大迭代次数"

2. 状态必须是可序列化和可检查的

反模式:Agent 的"思考"只存在于模型的上下文窗口中,出了问题你根本不知道为什么。

最佳实践:每个循环的完整状态(思考过程、工具调用、结果、错误)都应该被持久化。

{
  "loop_id": "loop_20260617_001",
  "iteration": 3,
  "thought": "需要验证数据库连接配置",
  "action": "run_command",
  "result": "连接成功,响应时间 120ms",
  "reflection": "配置正确,可以继续下一步",
  "progress": 45,
  "timestamp": "2026-06-17T10:30:00Z"
}

3. 必须有防死循环机制

反模式:Agent 陷入"检查错误 → 没解决 → 再检查 → 还是没解决"的无限循环。

最佳实践:多层防护机制。

防护层级 机制 触发条件
L1 最大迭代次数 硬上限,超过即终止
L2 进展停滞检测 连续 N 次无实质进展
L3 模式重复检测 相同或高度相似的思考/行动重复出现
L4 资源超限检测 耗时、Token、内存超过阈值

常见的循环反模式

橙色手册总结了 Agent 开发中最常见的 8 种循环反模式:

反模式 1:乒乓循环(Ping-Pong Loop)

症状:Agent 在两个状态之间来回切换,永远停不下来。

迭代1: "我需要检查配置文件"
迭代2: "配置文件看起来没问题"
迭代3: "等等,还是再检查一下配置文件吧"
迭代4: "配置文件确实没问题"
迭代5: "让我再确认一遍配置..."

解决方案:添加状态访问计数,同一类操作超过阈值强制转向。

反模式 2:分析瘫痪(Analysis Paralysis)

症状:Agent 一直在"思考"和"规划",但从来没有真正执行过任何有实质意义的行动。

迭代1: "让我先制定一个完整的计划"
迭代2: "计划还需要更详细一些"
迭代3: "我应该再考虑几个备选方案"
迭代4: "让我评估一下风险..."

解决方案:强制"行动阈值"——思考次数超过 N 次后必须执行至少一个工具调用。

反模式 3:工具滥用(Tool Addiction)

症状:Agent 痴迷于调用工具,明明可以直接回答的问题也要查半天。

用户:"2+2等于几?"
Agent:"让我搜索一下计算器工具..." → "让我用 Python 计算一下..." → ...

解决方案:添加"工具必要性检查",每次调用工具前必须证明为什么不能直接回答。

反模式 4:上下文膨胀(Context Bloat)

症状:每个循环都把完整历史塞回去,Token 爆炸,性能指数级下降。

解决方案:滚动摘要 + 关键信息保留,而不是完整拼接。

反模式 5:目标漂移(Goal Drift)

症状:跑着跑着,Agent 已经忘了最初的任务是什么。

用户:"帮我写个 Python 爬虫"
迭代5: "等等,我应该先优化一下日志系统..."
迭代10: "说到日志,ELK 栈好像也该升级了..."

解决方案:每个循环开始时重新宣读原始任务,并要求 Agent 明确说明当前步骤与目标的关联。

反模式 6:错误循环(Error Loop)

症状:同一个错误反复出现,Agent 每次都用同样的方式尝试修复,每次都失败。

解决方案:错误记忆库 + 尝试计数器,同一错误超过 N 次必须换策略或请求人工干预。

反模式 7:递归地狱(Recursion Hell)

症状:Agent 启动子 Agent,子 Agent 启动孙子 Agent... 无限递归下去。

解决方案:最大递归深度限制 + 任务复杂度评估,简单任务禁止启动子 Agent。

反模式 8:收尾困难(Completion Anxiety)

症状:任务明明已经完成了,Agent 还在不断地"检查"、"优化"、"验证",就是不肯结束。

解决方案:明确的完成标准检查清单,达到所有条件后强制终止循环。

循环工程的成熟度模型

橙色手册定义了 Agent 循环系统的 5 个成熟度等级:

等级 名称 特征
L0 无控循环 while true 一把梭,全靠模型自觉
L1 基础防护 最大迭代次数 + 超时机制
L2 可观测 完整状态持久化 + 进度可视化
L3 自调节 自动检测反模式 + 自动纠正
L4 自优化 从历史循环中学习,动态调整策略

大多数开源 Agent 框架停留在 L0-L1 级别。能够做到 L2(完整可观测) 的已经算优秀。真正达到 L3/L4 的系统凤毛麟角。

为什么这很重要?

我们正在进入一个 Agent 普及的时代。每个人都在谈论构建自己的 AI Agent,每个人都在喊"Agent is the new App"。

但残酷的现实是:
- 90% 的 Agent Demo 只能跑一次
- 80% 的 Agent 在真实场景下会陷入某种死循环
- 70% 的 Agent 开发者不知道如何调试自己的 Agent
- 60% 的 Agent 项目最终因为可靠性问题而放弃

Loop Engineering 就是解决这些问题的钥匙。它不是什么高大上的理论,而是每个 Agent 开发者都应该掌握的基本工程素养。

就像当年 Web 开发从"能跑就行"进化到软件工程化,今天的 Agent 开发也正在经历同样的过程。循环工程就是这个过程的重要里程碑。

橙色手册的价值不在于它提出了多少革命性的新概念,而在于它把无数人踩过的坑系统地整理出来,给后来者一张清晰的避坑地图。

如果你正在做 Agent 相关的开发,或者计划做,这本手册值得你认真读一遍。


作者: itech001
来源: 公众号:AI人工智能时代
网站: https://www.theaiera.cn/
每日分享最前沿的AI新闻资讯和技术研究。

本文首发于 AI人工智能时代,转载请注明出处。