惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

S
SegmentFault 最新的问题
J
Java Code Geeks
V
V2EX
Blog — PlanetScale
Blog — PlanetScale
博客园 - 司徒正美
Hugging Face - Blog
Hugging Face - Blog
F
Fortinet All Blogs
aimingoo的专栏
aimingoo的专栏
B
Blog
A
About on SuperTechFans
有赞技术团队
有赞技术团队
月光博客
月光博客
Microsoft Azure Blog
Microsoft Azure Blog
阮一峰的网络日志
阮一峰的网络日志
腾讯CDC
美团技术团队
大猫的无限游戏
大猫的无限游戏
爱范儿
爱范儿
N
Netflix TechBlog - Medium
C
Check Point Blog
Recent Announcements
Recent Announcements
博客园 - Franky
博客园 - 叶小钗
T
Tailwind CSS Blog

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
每天学一点AI知识:智能体(Agent)解决问题的流程
宇智波冰 · 2026-01-27 · via 人人都是产品经理

智能体(Agent)如何像人类一样思考并完成任务?本文揭秘智能体工作流程五步法,从任务明确到环境扫描,再到思考规划与执行动作,最后通过观察迭代实现闭环。深入解析每个步骤的核心机制与技术实现,助你理解AI智能体的运作原理与能力边界。

前文介绍过智能体的核心架构有3大部分(不包含部署和安全等部分):模型、工具、编排层。

详见:每天学一点AI知识:从预测性AI到自主性智能体

基于之前介绍的内容,结合笔者看过不少资料以及工作经验,分享智能体(Agent)的工作方法和步骤,总结为“智能体工作流程五步法”。

步骤 1:明确任务(Get the Mission)

明确任务是指智能体会根据用户的指令先做语义理解和意图识别等工作,推理出需要做的任务。

如:安排团队成员的差旅行程。

步骤 2:环境扫描(Scan the Scene)

环境扫描是指:智能体需要查询上下文窗口(context)中的历史对话信息,然后结合任务进行推理,将历史对话中的与此任务相关的信息摘录出来,如目的地、参与人员、时间等;

并且查询可以调用的工具(tools),如日历、第三方航班信息、日程软件API等。

工具(tools)中会包含:名称、所需参数、工具描述(可以实现的任务范围)。智能体查询工具时可以根据工具描述过滤出可以辅助完成目标的工具。

步骤 3:思考规划(Think It Through)

思考规划是智能体的核心,由推理模型驱动。

智能体结合任务(步骤 1)和环境信息(步骤 2)制定计划,启动一连串推理。

比如:

智能体结合“安排差旅行程”的任务,规划:1.先了解团队成员名单(调用 get_team_roster 工具查询到),2.通过 calendar_api 查询他们的可用时间,3.根据时间、人数去查询航班信息,4.最终给出一个行程规划清单。

步骤 4:执行动作(Take Action)

在编排层(笔者的其他文档有相关介绍)Agent构建出第3步中的规划;

开始执行规划的首个具体步骤,选择并调用相应工具——调用 API、运行代码函数或查询数据库。

再根据下一步骤持续的推进实际行动。

步骤 5:观察迭代(Observe and Iterate)

智能体观察动作执行结果(如 get_team_roster 工具返回 5 人名单),将新信息添加到上下文或“记忆”中,然后循环返回步骤 3:“现在已有成员名单,下一步通过 calendar_api 查询这 5 人的日程。”

通过循环执行并且持续“观察迭代”,实现上下内容不缺失,尽量避免凤头鸡尾、逐渐跑题等逻辑混乱的情况。

需要说明的是:由于大模型算力和记忆能力(上下文窗口存储能力等)的限制,部分Agent在执行超过它记忆能力的任务时,会出现做了下面忘记上面的情况。

就像是大家看书看到第四章,忘记第一章在讲什么一样~

详细原因推荐大家去读《思考快与慢》这本书,据说大佬们在设计AI的时候有参考这本书中关于人类大脑的记忆方式。

所以智能体的任务完成能力是有上限的,并不是能完整完成所有任务,需要根据具体使用场景评估Agent的执行情况

在实际项目中,要设计好兜底方案,并提前和用户传达此类风险。

本文由@宇智波冰 原创发布于人人都是产品经理,未经许可,禁止转载。

题图来自Unspalsh, 基于CC0协议。