惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Last Week in AI
Last Week in AI
D
DataBreaches.Net
腾讯CDC
Recent Announcements
Recent Announcements
有赞技术团队
有赞技术团队
A
About on SuperTechFans
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
Google DeepMind News
Google DeepMind News
Microsoft Security Blog
Microsoft Security Blog
云风的 BLOG
云风的 BLOG
罗磊的独立博客
月光博客
月光博客
MyScale Blog
MyScale Blog
U
Unit 42
Martin Fowler
Martin Fowler
Stack Overflow Blog
Stack Overflow Blog
T
Tailwind CSS Blog
Engineering at Meta
Engineering at Meta
N
Netflix TechBlog - Medium
G
Google Developers Blog
博客园 - 【当耐特】
D
Docker
I
InfoQ
雷峰网
雷峰网

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
Agent 开始自己进化了,产品经理的设计假设要变了
van ner · 2026-04-07 · via 人人都是产品经理

AI产品的设计逻辑正在被开源社区的革命性探索彻底颠覆。从Meta到阿里巴巴,六种让Agent实现自我进化的创新机制正在崛起——它们不仅突破传统'模型固定'的假设,更将用户行为转化为产品能力的进化燃料,重塑了产品经理对护城河与时间优势的认知。

我们设计 AI 产品,一直有一个没人明说的假设:

模型是固定的。它今天什么水平,明天还是那个水平。变化来自我们——我们改 prompt,我们迭代功能,我们调整产品逻辑。Agent 是工具,进化的主体是人。

但过去一年,这个假设正在被一批开源项目悄悄拆掉。

不是在论文里,不是在 demo 里——是在 GitHub 上,有代码,有 star,有真实跑通的实验结果。Meta、阿里巴巴、斯坦福、Nous Research,至少十几个方向在同时探路,回答同一个问题:怎么让 Agent 在不重新训练的情况下,越用越强。

他们已经找到了六种答案。

六种机制,从当次变好到进化方法本身也在进化

01 输出自审:当次变好

Agent 生成回答后不直接输出,先交给另一个 Agent 审查,有问题就打回重来,循环直到通过。

本质是把”做完”和”做好”拆成两个角色。LangGraph Reflection 是这个模式的标准实现。

但它有一个硬限制:对话结束,改进清零。它不记得上次犯过什么错。

02 持久记忆:跨次变好

把 Agent 的状态从对话级提升到 Agent 级——对话可以结束,知识不清零。

Hermes Agent 做得最完整。任务完成后自动把操作步骤提炼成可复用的技能文档,哪怕用户没发起对话,Agent 也会定期自己复盘,把有用的经验主动存下来。

它解决了一个真实的产品问题:很多有价值的经验出现在对话中途,用户不会刻意保存,但 Agent 会。

03 进化搜索:系统性变好

记住经验还不够。如果 Agent 的 prompt 写法、工具配置、工作流结构本身就有优化空间呢?

EvoAgentX 用进化算法同时优化三条线:prompt 文本、工作流拓扑、配置参数。阿里的 AgentEvolver 做得更细,能分析每一步操作的因果贡献——第3步帮了多少,第7步拖了多少后腿。

结果是:一个 7B 小模型经过自我进化,在特定任务上从 1.8% 跳到 32.4%。

04 对抗训练:没有数据也能变好

前三种都需要评估环境来打分。但如果连训练数据都没有呢?

Agent0 的方案是双 Agent 对抗:一个负责出题,一个负责解题。解题 Agent 变强了,简单题没有训练价值了,出题 Agent 就被迫生成更难的任务,倒逼对方继续进化。

竞争本身就是训练信号。基于 Qwen3-8B 的数学推理提升了 18%,超过了需要人工标注的方案。

05 自我修改:连改进方法本身也在进化

前四种有一个共同前提:改进机制本身是人设计的、固定的。

Meta 的 HyperAgents 打破了这个限制。Task Agent 负责干活,Meta Agent 负责改进——而 Meta Agent 不仅能改 Task Agent 的代码,还能改自己的代码。

实验中最让人印象深刻的现象是:系统自己发明了持久化记忆和性能追踪机制。没有人预设这些功能,Agent 判断自己需要,就写代码给自己加上了。

06 编排自优化:不改 Agent,改它外面的壳

最后一种视角最特别。改的不是 Agent 自身,而是围绕它的编排层——prompt 结构、检索策略、工具调用顺序。

斯坦福的 Meta-Harness 让 Coding Agent 来迭代优化这套脚手架。每一轮读取所有历史记录,提出新方案,跑评估,结果写回文件系统。

论文附录里有一段调试轨迹:Agent 在第3轮发现两次失败的共同原因,主动拆分变量分别测试;第7轮换了思路,只加一个环境快照,成了全局最优。这个过程和一个好的工程师调 bug 几乎一样。

这对产品设计意味着什么

六种机制读完,我想说的不是”这些工具你可以去用”。

它们加在一起,正在让产品设计的几个底层假设发生位移。

假设一:从设计静态能力,到设计成长路径

过去评估一个 AI 功能,问的是”它现在能做什么”。这个问题本身预设了能力是静态的。

但如果 Agent 会自我迭代,更关键的问题变成了:它有没有可以变强的空间?变强的速度够不够快?产品设计的对象,从一个截面变成了一条曲线。

假设二:用户行为本身,正在成为产品能力的一部分

持久记忆类的机制意味着:用户每一次使用,都在给 Agent 提供积累的素材。用户用得越多,Agent 就越懂这个用户,越懂这个领域。

产品的护城河,开始和用户的使用深度绑定在一起。

假设三:产品迭代的主体,不再只是人

过去产品变好,依赖的是产品经理发现问题、工程师改代码、重新上线。

现在有一部分迭代正在发生在这个循环之外——Agent 自己在跑,自己在改,自己在变强。这不是说产品经理可以退场,而是说设计时需要多想一层:我有没有给 Agent 留出自我改进的空间?我的产品架构支不支持这件事发生?

最后说一个判断

我不觉得所有产品团队现在都要立刻去研究这六种机制。

但有一件事值得认真对待:最先把自我迭代机制纳入产品设计的团队,会比别人积累一种很难被复制的优势。不是功能优势,而是时间优势——他们的 Agent 已经在某个垂直领域跑了半年、一年,积累了别人没有的经验库、技能库、改进轨迹。

这种优势不能靠堆资源追上来,因为它需要时间来生长。

而时间,是现在开始跑的人才有的东西。

本文由 @van ner 原创发布于人人都是产品经理。未经作者许可,禁止转载

题图来自Unsplash,基于CC0协议