惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

F
Full Disclosure
博客园 - 聂微东
博客园_首页
人人都是产品经理
人人都是产品经理
N
News | PayPal Newsroom
云风的 BLOG
云风的 BLOG
U
Unit 42
T
Tailwind CSS Blog
Recent Announcements
Recent Announcements
Security Archives - TechRepublic
Security Archives - TechRepublic
T
The Blog of Author Tim Ferriss
Stack Overflow Blog
Stack Overflow Blog
The Register - Security
The Register - Security
The Hacker News
The Hacker News
博客园 - Franky
Engineering at Meta
Engineering at Meta
Jina AI
Jina AI
月光博客
月光博客
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
F
Fortinet All Blogs
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
C
Check Point Blog
C
Cyber Attacks, Cyber Crime and Cyber Security
有赞技术团队
有赞技术团队
TaoSecurity Blog
TaoSecurity Blog
博客园 - 司徒正美
GbyAI
GbyAI
G
Google Developers Blog
B
Blog
G
GRAHAM CLULEY
Y
Y Combinator Blog
雷峰网
雷峰网
爱范儿
爱范儿
酷 壳 – CoolShell
酷 壳 – CoolShell
D
Darknet – Hacking Tools, Hacker News & Cyber Security
Microsoft Azure Blog
Microsoft Azure Blog
WordPress大学
WordPress大学
V
V2EX
罗磊的独立博客
Know Your Adversary
Know Your Adversary
AWS News Blog
AWS News Blog
T
Troy Hunt's Blog
S
SegmentFault 最新的问题
P
Privacy & Cybersecurity Law Blog
T
Threat Research - Cisco Blogs
H
Help Net Security
N
Netflix TechBlog - Medium
Help Net Security
Help Net Security
L
LangChain Blog
D
Docker

少数派

派早报:Google 发布 Fitbit Air 等 - 少数派 「新人报到」確認需求,再開始 - 少数派 从 SOLO 独立开发者社区,我看到了越来越多开发者开始做自己的产品 - 少数派 我怎么管理那些"不常做,但总会忘"的生活事项 - 少数派 人形机器人量产元年,数据才是具身智能的“生死线” - 少数派 BuhoLaunchpad 高度还原 Mac 启动台:开发历程与思考 - 少数派 五年陪伴依然不舍,DIY 换壳后让罗技 MX Master 3 继续服役 - 少数派 新玩意 240|少数派的编辑们最近买了啥? - 少数派 一日一技|为什么你应该关闭 iOS 的键盘声音 - 少数派 我做了个插件和 Skills,一键提取任何网站的设计规范 Design.md - 少数派 住在三四线城市的你,该开始录播客了 - 少数派 甘南秘境,大白高国 - 少数派 AI的审美:谁让把我变成川内倫子 - 少数派 返工怎能不烦恼,打工人片单总有一部是你的「嘴替」 - 少数派 为了让「上厕所」更健康,我做了一个小工具 - 少数派 AI + Skill,能够让生成的文章去除 AI 味吗? - 少数派 新玩意|韶音OpenDots ONE 耳夹式耳机 - 少数派 《美满》| 在每一个春天的晚上相爱(362) - 少数派 新玩意|优篮子 PS01 MagSnap 磁吸支架 - 少数派 自我整合手记 | 我开始早睡了:用稳定规则,为自由托底 - 少数派 用龙虾(OpenClaw)两个多月,我最深的12个体会 - 少数派 听歌时间到,12 张你可能错过的 2025 华语乐坛好专辑 - 少数派 承诺能追吗 - 少数派 macOS 26启动台没了? 我做了个不一样的App启动器 - Keboard - 少数派 《四海为家的人》| INTJ对话INTJ(361) - 少数派 你发过的那些黑历史,是时候一次清干净了 - 少数派 新玩意:安安静静玩,越玩越专注:计客密码机 - 少数派 iPad 用户首次体验 Android 平板:vivo Pad6 Pro - 少数派 数据逻辑强 - 少数派 极北行+ | 一路向北,探访日本至北之地 | 001 - 少数派 万字剖析:千问App深度体验报告(2026) - 少数派 在2026年,如何真正防止别人抄袭你的作品 - 少数派 怎么用 50 块搭个 AI 语音助手?我踩了 3 天坑 - 少数派 YeeroAI:让 AI 对话真正成为知识管理的一部分 - 少数派 爬泰山 - 少数派 「旅图显影」 App 更新:这次,我们补上了一点「手感」 - 少数派 假期出门太折磨?我的 23 条经验帮你规划惬意旅行 - 少数派 工作流会变吗 - 少数派 Claude Opus 4.6 怎么用最省钱?我测了 5 种方案 - 少数派 GPT Image 2 让图文并茂不再稀罕 - 少数派 用户侧出发——什么是AI,我要不要学习? - 少数派 找片、转存、整理、播放一条龙!让你的付费网盘值回票价 - 少数派 欢迎试用!日课一问2.0插件 - 少数派 自己做的MDeditor,原本想购买 Typora 试了两次支付不成功,干脆自己做一个 - 少数派 vibe coding了一个 3MB 的小工具,让 ~/Downloads 彻底告别混乱 - 少数派 因为受不了 Mac 的风扇策略,我做了一个风扇控制工具 - 少数派 别只怪模型 - 少数派 Warp 终端的 AI 功能怎么用?我测了一周的体验 - 少数派 AI 写代码老是出 bug?这 5 个配置我后悔没早知道 - 少数派 「新玩意」苹果出相机可能就这样:Sigma BF + 45mm F2.8 DG Contemporary - 少数派 一个面向2030年的AI操作系统是什么样子的:浅谈cola这款有灵魂的Agent - 少数派 别只看写代码 - 少数派 每天解决10个问题,还是一口气攻坚解决400个? - 少数派 AI 交易机器人怎么搭?我用 Claude 跑了一周实盘 - 少数派 Maptoposter Online:把你爱的城市画成艺术海报 - 少数派 Function Calling 怎么用?我测了 3 个模型发现差距真大 - 少数派 Legend Talk:我做了个 AI 圆桌,让 160 位思想家围着你的问题转 - 少数派 如何找到自己的蓝方?在小县城寻找压力测试 - 少数派 语音输入与软件接口|2026年聊AI时,我们都聊些什么(上) - 少数派 混动已经卖爆,纯电又来补刀——钛7闪充版简直“不讲武德” - 少数派 本月玩什么|朋友收藏、识质存在、沙罗周期 - 少数派 为什么要每天坚持输出? - 少数派 Claude API 挂了好几个小时,你的项目有备用方案吗? - 少数派 Function Calling 没你想的复杂——我用它做了个有点用的工具 - 少数派 登录系统立即播放视频或者图片音乐的软件 - 少数派 我为什么创建 FlipHTML5 下载工具 - 少数派 残局没电?多品牌外设电量统一管理软件EasyBluetooth已支持RTSS游戏内显示以及AIDA64 - 少数派 前往通义路的路 - 少数派 太好看了,媲美Sun的个人导航页,NAS部署星云门户 - 少数派 乌黑嘴唇“一键检测”上线了 - 少数派 派早报:Claude AI 接入多个创意软件生态、FILCO 生产方接手品牌等 - 少数派 【更新】BearCLI、Claude 连接器与 MCP 服务器 - 少数派 记了上千条流水,还是看不懂财务?我做了一个让 AI 读懂账本的工作台 - 少数派 MINI R56 升级原厂 Sport 模式 - 少数派 新玩意 | 一棵柠檬树(仿真版) - 少数派 Momenta的“物理AI”野望,需迈过“含摩量”这道关 - 少数派 网页直接投屏控制手机!NAS一键部署PandaScrcpy,流畅丝滑可远程。 - 少数派 众测|邀你一同探索随身 AI 硬件入口 YoooClaw C·ONE - 少数派 2050大会:分享时间是真诚 参会记 - 少数派 iPad 赋能电影创作:国内首部宣纸手绘长片《燃比娃》的幕后故事 - 少数派 AI的审美:我用 8 个大模型给 100 张旅行照片打分 - 少数派 普通人如何破圈?去参加一个本地协会 - 少数派 把极空间的图标全换了,主题DIY全攻略打造你的专属NAS桌面 - 少数派 电子便签墙,帮你实现便签自由 - 少数派 我如何用三个 CLI 工具取代文档创建需求 - 少数派 原来真的有人可以玩一辈子 - 少数派 社区速递 139 | 派友热议三月买了啥、复古单反尼康 Df 体验 - 少数派 06 作品的赏析与评价 - 少数派 TDS REVIEW|索尼 WF-1000XM6 降噪真无线耳机体验 - 少数派 35.98万起售的第二代腾势D9,我看重的不是堆料,而是不凑合 - 少数派 鼠须管 Squirrel 皮肤配置指北 - 少数派 从watch ultra2换到redmi watch6 - 少数派 派早报:阿里巴巴发布视频生成模型 HappyHorse 1.0 等 - 少数派 别迷信1M - 少数派 家人们天塌了!网盘“大封杀”,多个渠道多条路,NAS部署PanHub - 少数派 AI与人勾心斗角!NAS一键部署AI狼人杀,假日休闲必备。 - 少数派 电商必备!Comfyui工作流批量生图插件,一次生成12张!支持Nano banana pro模型 - 少数派 Comfyui工作流配置Gpt-image-2模型教程,0.03/张 - 少数派 OpenClaw第三方APi怎么配置?可使用Gpt-image-2模型 - 少数派 会员社区话题精选 Ep. 103 - 少数派
Agent的新思路:构建多agent系统 - 少数派
2025-07-29 · via 少数派
本文所有图片来源:anthropic工程博客 How we built our multi-agent research system

Anthropic 团队上个月发了一篇工程博客,讲述了他们如何构建Claude的多智能体研究系统。乍一看,这篇文章似乎是一个复杂的技术话题,但仔细读下来,你会发现它其实探讨的是一个更深层次的商业和技术问题:

当单个AI的能力达到了极限,接下来我们该如何前进?

对于这个问题,Anthropic 给出了一个可供参考答案:构建多智能体系统。

本篇结合 Anthropic 的工程博客,以及个人对智能体的认知,对构建多智能体系统的原理和方法论进行探讨。

废话不多说,先从这篇工程博客的核心要点说起:

1. 让多个智能体协同工作

“让多个智能体学会协作。”——这是这篇博客的核心观点。

我们可以把这种方法想象成团队合作:假设你是一个宠物公司的 CEO,想了解 2025 年中国宠物市场的机会,以及哪些细分品类值得布局。如果只有你一个人来做这件事,即便你再聪明,工作也得一步一步来:先查宏观经济数据,再看行业报告,再到竞争对手分析,最后分析消费者的购买行为。这一套流程下来,对个人而言工作量不小,而且可能要花上几周时间。

但如果你有一个团队,事情就不一样了:

  • 市场分析师:专注宏观趋势
  • 行业专家:深入研究某些细分市场
  • 数据分析师:专门解读消费者的行为模式

每个人各司其职,大家并行作业,最后汇总给你。这样做的好处是,时间缩短了,效率大大提高,做决策也能更快。通过这种方式,团队的效率就像是多智能体系统的协作:每个智能体负责一个环节,最终汇总出的结果不仅更快,还更加精确和深刻。

这种多智能体协作的方式,在复杂的研究任务中,显得尤为重要。

正如原文所说:搜索的本质是“压缩”,即从海量信息中筛选、压缩出最有用的那一撮。

而多智能体协作时,每个子智能体像是执行专员,各自从不同角度去查资料、找关键点,然后再把他们认为最重要的内容提炼出来,交给主智能体统一汇总——这恰好就是搜索的本质。

而这种协作方式,也打破了单一智能体的局限,能够通过并行处理加速任务执行,极大地提升了处理信息的深度和广度

问题来了:这个多智能体系统,具体是如何运作的?

2. 多智能体如何并行?与RAG有何不同?

AI Agent 和 workflow,在过去总会被人混为一谈,原因在于两者在执行任务时都表现出一定的线性流程结构,目的是协助人类按部就班地进行任务,比如搜索这个场景,可以这样拆分工作流:

接到目标 → 搜索信息 → 分析结果 → 给出答案

每一步都依赖上一步的完成,好处是清晰且符合人类的做事逻辑,当坏处是效率受限。

而 Anthropic 发现,真实的任务往往是并行的。例如问一个问题:“哪些生意在 2025 年最值得投资?”这不仅仅是一个简单的查询,它需要涵盖多个维度:技术趋势、商业模式、财务状况、竞争格局等,让一个智能体按部就班地深度研究,可能需要花费几十分钟。

而如果采用并行架构,这个任务的执行就可以变得更加高效:

如上图,主智能体首先分析问题,识别出几个关键的研究方向,然后创建多个子智能体,分别负责不同领域的研究。每个子智能体独立工作,可以同时调用多个搜索工具,最终主智能体汇总所有的发现,形成完整的答案。

在 Anthropic 的内部评估中,多智能体系统的搜索效果相比于单智能体提升了 90.2%

同时也将复杂查询的研究时间缩短了 90%

同样是信息检索,这种多智能体并行搜索的原理,跟RAG也存在明显的区别。

RAG 主要有两个功能:检索信息、并引用信息生成回复。走 RAG 链路会让模型从大量资料中找到相关的信息,然后再用这些信息生成一个完整的回复,侧重单一智能体的信息获取能力与生成能力,这种方法会受限于单一智能体的能力,这也导致了单一智能体在 Anthropic 的内部评估中的落败;

而多智能体系统则像一个庞大的团队,各个智能体分别承担不同的任务,进行信息的深入探索、分析和组织,如:Researcher 负责深度挖掘和收集资料;Organizer 负责把收集来的信息进行整理和组织;Judge 负责评估结果的准确性和质量。分工明确、各有所长,最终合作完成任务。

如果说 RAG 是对于相关信息的获取、梳理、生成,那多智能体还做到了对相关信息的主动探索、分析、再组织,提升的不止是检索能力,还有对信息的“认知深度”。

因此从 RAG 到多智能体,变化的不只是执行方式,而是AI处理信息的广度与深度。

而当 AI 开始协作、判断、复盘,PE 的角色也需要随之升级。

3. 多智能体的PE有何不同?

过去我们构建 PE 的核心目的,在于让模型按照指令完成某个具体的任务,因此需要手把手教学,我们的角色是“老师”;但到了多智能体系统里的PE,我们的角色不仅仅是“老师”,还是一个“项目经理”

因为这时候不再是单个 AI 在干活,而是若干个智能体在协同工作,因此 PE 不能仅仅给一个明确的指令,而是像一个项目经理一样,去搭建一套指挥“谁应该具体做什么任务”的调度系统,由主智能体负责安排调度子智能体,且发送给子智能体的指令必须足够清晰,否则就容易出岔子。

例如 Anthropic 发现:主智能体如果只是给出一句模糊的指令,比如“研究半导体短缺问题”,听起来挺明确,但底下几个子智能体执行出来的内容全是各说各话、不成体系,一个跑去复盘 2021 年的车规芯片危机,两个重复研究了 2025 年的半导体供应链,大家都很努力,但努力的方向完全没对齐。

如果是个真实项目,大概率会造成生产事故。

因此在多智能体系统中,我们构建PE,就是要确保我们构建的 PE,能够让主智能体搞懂用户的目标,还得搞清楚,这个目标能不能拆、该怎么拆、谁负责做什么任务、谁和谁之间不能重复,每个子智能体的专长分别是什么?具体负责什么?任务边界在哪里?

每一个细节,都会影响整个系统的效率和准确率。——这听上去是不是就像项目经理?

一个有效的多智能体 PE ,就是需要让整个系统协作顺畅、稳定产出。

那如何构建这样的 PE?我们可以看看 Anthropic 的实践总结:

1. 学会站在智能体的角度思考:这是 Anthropic 老生常谈的方法论了,我们需要观察每一步的决策路径,发现失败模式,为提示优化提供直观依据

2. 教会主智能体清晰地分派任务:主智能体需要清晰地描述任务目标、输出格式、使用工具、信息来源以及任务边,否则子智能体容易重复、遗漏或跑偏

3. 根据任务复杂度调整调用规模:不同任务需要匹配不同数量和类型的子智能体,例如简单事实查找只需一个智能体+3-10次工具调用,而复杂研究可能要10+子智能体,进行分工协作

4. 慎重选择调用工具:要指导智能体调用合适的工具,且优先选择专业工具

5. 智能体自我复盘优化机制:可以用智能体来复盘智能体,出错了让另一个智能体来复盘分析、优化,通过失败案例分析、提示改写、工具描述优化,让系统实现持续改进

6. 由广度到深度的搜索策略:先进行广泛探索,再聚焦深入,是更高效的研究路径,提示中应引导智能体避免一开始就钻牛角尖

7. 思考过程显性表达:通过让智能体输出“思考过程”,主智能体能更好地规划、评估任务路径与资源分配

8. 任务并行,提速增效:包括主智能体并行启动多个子智能体,子智能体同时调用多个工具,有效压缩任务执行时间

在上述的8条经验总结中,有一个词频繁出现:“工具”。

Anthropic 在实验中发现,很多任务失败并不是因为智能体不够聪明,而是没调用正确的工具。因此多智能体系统需要检查所有可用工具,把工具用法和用户意图对上,必要时上网广泛搜索,优先选专用工具而非通用工具,且每个工具都得有明确用途和清晰说明,方便智能体作出判断,避免因为对工具的描述不清,导致智能体跑偏。

一个好用的多智能体系统,离不开 PE 的构建,离不开准确的工具调用。但问题又来了:

多智能体系统的构建如此复杂且如此强调“协同”,这也就意味着单个智能体如果出现判断失误,就有可能引发连锁反应,导致整个任务翻车。

针对这个问题,Anthropic 又给出了怎样的解决的思路?

4. 稳定运行的4个关键:复盘、兜底、迭代、渐进上线

为了让多智能体系统在实际运行中更稳、更可控,Anthropic 在工程层面做了四项关键设计:

1. 复盘:智能体自我优化机制(Let Agents Improve Themselves)

按照以往的经验,一旦AI出错,就得我们来进行优化,而 Anthropic 并不满足于让AI只是被动执行,而是尝试让AI具备一种“自我反馈、持续改进”的能力。

从结果看,这种自我优化机制显著提升了系统的表现,任务完成时间缩短了约40%。

具体流程上图亦有提及:当一个子智能体在执行中失败,这个系统会自动调用另一个“诊断型智能体”,分析失败的原因,比如是不是搜索方向错了、工具调用混乱等等,诊断的同时也给出优化建议。

复盘当然不能只找出问题,因此 Anthropic 还将这些失败案例和改进方案,都投喂回系统中积累成经验,供未来的任务参考。

这又有点像我们人类的做法:我们不可能从不犯错,但是出了问题能快速复盘、调整策略、避免再犯,Anthropic 做的,就是把这种复盘机制移植到AI系统内部,让 AI 团队自己总结、自己成长。

如果说以前AI需要人类来发现错误并提供优化,那这套自我优化机制的意义在于:AI 错了也能自己发现、自己改进、积累成经验,避免下次别再错。

2. 兜底:检查点机制(Regular checkpoints)

由于在多智能体系统中,任务往往不是一步到位的,而是需要多个智能体接力完成,因此网易中间哪一环出了问题,很可能整个任务链路就卡住了。如果任务执行一半出错,系统全部重启、从头再跑一遍,这显然不现实,尤其是在任务路径很长、成本很高的多智能体系统中(后面我们会谈及多智能体系统的成本问题)。

出错一次,就重跑一次,效率低不说,还容易引发级联故障

Anthropic 对此给出的思路是,引入类似“存档”的机制,也就是检查点机制。在任务的关键节点,主智能体会自动保存一次“系统状态”,如果后续子任务失败,系统就能从上一次成功的检查点恢复,而不是“推倒重来”。

它的意义在于:大大提升了系统的容错能力,让多智能体系统在面对复杂、不确定任务时,也具备了抗风险能力。未来这种机制可能还会进一步演进,例如智能体能自主决定什么时候该“存档”?哪个节点是“风险节点”要重点注意?这也是多智能体系统能够稳定运行的重要前提。

3. 迭代:全链路Tracing日志(Full Production Tracing)

正常情况下,我们发现模型出现问题,只能知道 response 错了,或者知道存在这一类 badcase ,无法深究,只有查看这些数据对应的链路,才能搞清楚到底是哪一步出了问题?

而在多智能体系统中,任务执行链条更长、参与角色更多,一方面如果不记录链路的全过程,后续复盘无从下手;另一方面由于智能体数量较多,如果发现了问题再找对应的链路查证,效率也较低。

因此 Anthropic 在系统中引入了一套全链路Tracing日志,用来记录整个任务执行过程。包括每个智能体接到的任务指令、调用了什么工具、工具的响应情况、智能体中间的判断逻辑、输出的内容、收到的反馈等等,全都记录在案。

这相当于给每个智能体配了一台工作记录仪,把它做了什么、为什么这么做,都拍了下来。一旦出问题,主智能体或者运维人员就能回看工作录像,迅速定位是哪一步决策偏了、哪个工具响应错了、信息源是不是有误,从而精准调优。

而且这套日志系统不仅可以用于排查问题,也可以作为日常优化的重要数据源。比如长期观察某些工具的调用失败率高,就说明它的描述或接口可能需要优化。

因此全链路 trace 是支撑多智能体系统“可解释、可优化、可维护”的基础设施。没有它,系统复杂性一旦上升,就只能靠拍脑袋调试,效率低下还不稳定。

4. 渐进上线:渐进式部署策略(Rainbow Deployment)

由于多智能体系统本身的构建就较为复杂,因此单个智能体一次很小的更新,在多智能体系统里可能引发“连环反应”。比如改了一个子智能体的PE结构,结果导致依赖它输出的另一个智能体出现问题,整个链路报错;或者你替换了一个工具接口,旧版本的调用逻辑不兼容。

Anthropic 为了解决这个问题,引入了类似互联网产品常用的渐进式部署策略(又译作“彩虹部署”):新旧版本并行跑,先在小范围测试新版的稳定性,再逐步扩大范围,直到全面切换,确保新版本的更新平稳落地,不影响用户体验。

渐进式部署不仅让更新更安全,也可以给我们更多试错空间,我们可以放心地试验新prompt、新链路的输出效果,引入新开发的工具插件,也不必太担心翻车造成太大的影响。

毕竟多智能体系统,已经不是单个的大模型,而更像一个具体的产品,所以更新策略要像产品一样稳扎稳打,避免翻车。

5. 现阶段多智能体系统的缺陷

上面梳理了一些多智能体系统的原理、方法论和优势,难道多智能体就是AI Agent的版本答案?

并非如此,至少目前,这不算一个通用的、适用于绝大多数场景的解决方案。

原因主要有三个,首先就是:贵,真的太贵了

Anthropic 的统计数据显示,多智能体系统的 token 消耗量,是普通 chat 的 15 倍。也就是原来一个任务花 1 块钱,用多智能体系统要花 15 块,而且这还只是算 token 的账。如果再加上工具调用、子智能体并发调度这些操作层的资源开销,整体成本会更高。

其次,多智能体系统并非在所有场景下,都能稳稳胜过单个智能体

一些需要所有智能体共享上下文或涉及大量智能体之间依赖的领域,目前多智能体系统并不适用,具体而言就是代码生成类任务,每一步都紧密关联、一环扣一环,分工反而容易乱套。而且现在的大模型,还不太擅长一边协调任务、一边并行完成,让多个智能体同时在线合作,难度依然很大。

第三个缺点,是多智能体调试的难度。

在前文中我们不断提及 Anthropic 针对多智能体系统给出的解决方案,而一个系统,值得Anthropic 花一整篇工程博客、给出如此多的、针对性的解决方案,本身就已经说明这个系统,目前还是过于复杂。

因此,至少此时此刻,多智能体系统还远远不是一个适用于多数场景的解决方案,而是一个高成本、高产出、适用于高价值任务的解决方案,如果说搭建单个智能体是“轻工业”,那么搭建多智能体系统毫无疑问属于门槛极高的“重工业”。

在当下,它可能更适合那些,能够同时满足那些价值量足够高场景适合多智能体协同工作、并且团队具备复杂工程运维能力,三个条件的任务。

虽然适用范围较窄,但Anthropic 对多智能体的探索并非没有意义,至少它给我们提供了另外一个视角:

过去我们在谈 Agent 时,更多关注的是「能力」。而多智能体的方向,让我们得以开始思考「组织」。

当单个 AI 的能力逼近天花板,「组织」也成为一种提升 AI 能力的思路和方法。再往前走,也许就是多个 AI 之间的组织结构进化?

未来的 AI 组织,能不能像人类的公司一样运转?能不能像实现自调节?能不能自己组队、定目标?

如果接下来真能走通这条路,那或许就是通向 AGI 的关键路径之一。

这不一定是终点,也一定不是终点,但有可能指向下一个奇点。