惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

The GitHub Blog
The GitHub Blog
有赞技术团队
有赞技术团队
Apple Machine Learning Research
Apple Machine Learning Research
V
V2EX
Engineering at Meta
Engineering at Meta
美团技术团队
H
Hackread – Cybersecurity News, Data Breaches, AI and More
博客园 - 司徒正美
I
InfoQ
S
SegmentFault 最新的问题
博客园 - 叶小钗
N
Netflix TechBlog - Medium
Y
Y Combinator Blog
IT之家
IT之家
博客园 - Franky
大猫的无限游戏
大猫的无限游戏
人人都是产品经理
人人都是产品经理
T
The Blog of Author Tim Ferriss
月光博客
月光博客
The Cloudflare Blog
U
Unit 42
GbyAI
GbyAI
L
LangChain Blog
Microsoft Azure Blog
Microsoft Azure Blog

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
Hermes Kanban:4 个 Agent 怎么像团队一样干活(译)
jovi_AI电报 · 2026-06-10 · via 人人都是产品经理

AI Agent 的协作难题终于被 Hermes Kanban 破解!这款工具通过任务简报机制和共享看板,让多个 Agent 像真正的团队一样无缝协作,甚至能在手机上通过 Telegram 操控整个开发流程。本文不仅揭秘了其核心的六列看板模型和编排者机制,更通过搭建 Google Docs 克隆版的实战案例,展示了 4 个 Agent 如何在 20 分钟内自主完成全栈开发。

AI Agent 本该像团队一样协作。

你描述目标,它们分工干活,一个接一个往下传递——这是理想状态。

现实恰恰相反。每个 Agent 从零开始,不知道其他 Agent 做了什么、改了哪些文件、接口长什么样。每次交接都是冷启动,任务质量在跨 Agent 传递的时候就开始打折扣。

Hermes Kanban 解决了这个问题。

每个任务都能在崩溃和重启中存活。每份任务简报精确携带下一个 Agent 所需的一切信息。每次失败都被完整记录,重试的时候能准确知道哪里出了问题。

最棒的是——整个团队可以从手机上操控。你在 Telegram 上创建和推进任务,Agent 在你离开电脑时自动接手干活。

本文从零搭建完整系统:协调模型、任务简报机制、一个 4 人 Agent 软件团队,大约 20 分钟搞定。

为了演示效果,我用这个 Agent 团队搭建了一个可运行的 Google Docs 克隆版,包含 AI 功能、生产级后端,全部由这个 Agent 团队自主完成。

为什么一个 Agent 不够

比如你想加个密码重置功能,工作自然分成三块:后端写接口、前端对接接口做界面、测试端到端验证。

你可以让一个 Agent 全干,但上下文窗口很快就满了——三步之前做了什么它已经忘了。你花在管理它的时间,比它帮你省的还多。

把工作拆给各自领域的 Agent 又会产生新问题:前端 Agent 怎么知道后端做了什么?接口叫什么?字段是什么?

这就是 Hermes Kanban 要解决的共享上下文问题。

核心模型

传统的看板很简单:任务有标题、描述、负责人和状态,有人领走、推进、关闭。看板是唯一的依据。

Hermes Kanban 保留了这套模型,只是把人换成了 Agent。

每个任务看板卡片在崩溃和重启中都能存活。Agent 完成工作时会写一份摘要:改了哪些文件、做了什么、下一个 Agent 需要知道什么。

下一个 Agent 开工之前,先读这份摘要。

这个摘要才是整个系统的核心——它把一群互不相识的 Agent 变成了一支真正的团队。

看板六列

一张看板,六个状态列:

  1. 分流(Triage):粗略想法先落这里。比如”我想要登录鉴权”这种还没完整需求规格的,先丢进来
  2. 待办(Todo):任务已创建,但等前置依赖完成
  3. 就绪(Ready):依赖满足了,等 Agent 来领
  4. 进行中(In Progress):Agent 正在跑
  5. 阻塞(Blocked):Agent 撞墙了,标记给人来处理
  6. 完成(Done):含完整运行历史、摘要和元数据

编排者

编排 Agent(Orchestrator)就是整个团队的项目经理

它读你的高层目标,查有哪些 Agent 可用,把目标拆成相互关联的任务卡片,然后退后——它自己不写代码、不跑测试,只做协调。

有一条关键规则:创建任务之前,先查一下现有的 Agent 配置(profile)列表。系统会静默跳过那些没有匹配到真实 Agent 的任务,所以第一步永远是先看清团队里有什么人。

但实际上,你什么都不用操心。在 Telegram 上给项目经理说一句需求,编排者自动接手,拆任务、分配、推进,全程自动走完。

三种协作模式

流水线模式(Pipeline):任务依次依赖,A 做完 B 才能开始,B 做完 C 才能开始。只有第一个任务从”就绪”状态开始,其余排队等前置完成。

人工介入模式(Human in the Loop):Agent 做到一半发现拿不准的地方,主动停下来问人。你在手机上看板里验证、修复、解除阻塞,然后它继续跑。

分流补全模式(Triage Specifier):粗略想法随手丢进”分流”列,系统自动把它展开成一份有完整需求规格的任务卡片。

搭建步骤

四个 Agent、一块共享看板、项目经理通过 Telegram 可达。具体步骤:

  1. 创建 Agent 配置:用hermes profile create –clone给每个角色建独立配置
  2. 写 SOUL.md:给每个 Agent 定义身份和思维方式(项目经理、后端开发、前端开发、测试各一个)
  3. 装技能包:从 687 个可选技能包里挑合适的(后端有 InsForge、前端有 frontend-design、测试有 webapp-testing 等)
  4. 初始化看板:hermes kanban init,创建本地数据库
  5. 启动网关:用 Telegram 的 @BotFather 拿 bot 令牌,@userinfobot 拿你的用户 ID
  6. 发第一个项目:在 Telegram 上跟项目经理说需求,它自动拆任务分配

演示项目:Google Docs 克隆版

为了验证整个流程能跑通,我用这个 4 人 Agent 团队从零搭建了一个 Google Docs 克隆版——包含 AI 功能、生产级后端,全部由 Agent 自主完成。

后端基于 InsForge(开源),Agent 自动生成了数据库模型、REST 接口和完整的后台管理面板。

技能包从 687 个中按需挑选,后端、前端、测试各有对应的专用包。

踩坑提醒

数据库过载:2-4 个 Agent 并行没问题,10 个以上同时高频写入会变慢。用hermes kanban dispatch –max 4限制并发数。

临时工作空间会被清:任务完成时,Agent 的临时工作目录(scratch)会被擦除。编码任务建议用 git worktree,或者在任务描述里写明项目的固定路径。

本地模型扛不住:多个 Agent 同时跑本地 GPU 容易压垮,用–max 2限制并行数。如果用云端 API(Claude、GPT-4o 这些),基本不用担心。

全貌一张图

  • SOUL.md= Agent 的固定身份(它是谁、怎么思考)
  • 技能包(Skills)= 具体工作的步骤指南
  • 记忆(Memory)= 跨会话沉淀的环境知识
  • 看板(Kanban)= 协调层:共享状态、上下文传递、随时可人工介入

看板实际长什么样

每列对应一个状态,每张卡片对应一个任务。Agent 完成工作后自动移动卡片。

可以按 Agent 分列查看——谁在干什么一目了然。

点开卡片能看到完整信息:任务描述、运行日志、摘要、进程 ID、完成标准。

评论区观点

文章发出去之后,评论区最有意思的讨论集中在两个方向:交互方式和数据架构。

交互层面,最大的痛点是浏览器里套终端——想解除一个阻塞,还得切到命令行去操作,体验确实拉胯。有人很快给出了方案:一个开源的聊天优先的 Hermes Web UI,自己部署直接对接现有的环境。Akshay 本人也回应说这正好补上了文章里提到的最大短板。从这些反馈能看出来,看板的协调模型本身没太大争议,真正的瓶颈在交互层——怎么让人更方便地介入和操控。

数据架构层面,有人分享了用知识图谱混合数据库替代纯看板的做法,额外加了影响范围检查、文件依赖追踪、不变量目录等防护机制。这个方向挺有前瞻性的,因为看板本质上是个轻量的状态机,当 Agent 团队规模变大、任务关联变复杂之后,纯看板可能不够用,需要更结构化的知识表示。还有一个很实际的问题:Agent 写的摘要太长会被截断,关键信息就丢了。

另外也有人提到/goal命令是解锁看板全部能力的关键——标准化的任务指令格式加可视化的协调层,两个加在一起才完整。

下一篇我们聊/goal——这个让 Codex、Claude Code 和 Hermes 三个工具说同一种语言的底层标准。

本文由 @jovi_AI电报 原创发布于人人都是产品经理。未经作者许可,禁止转载

题图来自作者提供