惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

B
Blog
Microsoft Security Blog
Microsoft Security Blog
Jina AI
Jina AI
博客园 - 叶小钗
J
Java Code Geeks
博客园 - 聂微东
博客园 - 司徒正美
大猫的无限游戏
大猫的无限游戏
阮一峰的网络日志
阮一峰的网络日志
V
V2EX
美团技术团队
WordPress大学
WordPress大学
M
MIT News - Artificial intelligence
雷峰网
雷峰网
酷 壳 – CoolShell
酷 壳 – CoolShell
GbyAI
GbyAI
罗磊的独立博客
T
The Blog of Author Tim Ferriss
aimingoo的专栏
aimingoo的专栏
T
Tailwind CSS Blog
The Cloudflare Blog
Stack Overflow Blog
Stack Overflow Blog
N
Netflix TechBlog - Medium
小众软件
小众软件

开源软件

分享一个免费汇率 API:已经稳定运行 2 年(每月 500 万次请求) - V2EX [开源分享] 仅需一个脚本就能将目录转 s3 服务, FluxonFS vs Alluxio 5x 吞吐 - V2EX 推荐自用「文字转朗读音频」工具: Edge TTS 语音合成助手(开源 · 免费 · Windows) - V2EX 做一个 iOS 27 风格的 V2EX 客户端 - V2EX macOS 原生终端 Termite 1.18 版本发布-新增工作区灵感来自 ARC 浏览器 - V2EX 今天给 Berth 连发了 v1.3 和 v1.4 两个版本 - V2EX [开源]给分散 Cursor 账号做了个自托管额度与用量看板 - V2EX [开源] Git AI Control: Git AI 的本地隐私与策略控制面板 - V2EX 我做了一个可从手机远程管理 Mac 的开源控制台: Flux Monitor - V2EX 什么都没干 被帖上莫须有的罪名! - V2EX 你们都在用 AI,而我用古法编程做了一个剪映 - V2EX 终于有可以替代剪映的开源视频工具了!数据全本地,还能用 AI 聊天剪视频 - V2EX 开源一款 MAC 原生终端和一款原生 SSH 客户端 PurePic:一个由 AI 全制作的轻量图片查看器 然人赚不到自己认知以外的钱! 写了一个轻量的后台导航页 Admin Dock, Docker 一键部署 终于做出了我理想中的那个优雅的跨平台阅读软件 cursor canvas 技能复刻 一款跨设备的重复文件清理器 Excelize 开源十周年,发布 2.11.0 版本 OmenXHub 更美观 轻量 功能完备的暗/光影精灵控制中心 boss 直聘 ai 招聘助手(hr 用 轻量 macOS 上模拟 iOS 设备定位的工具 [独立开发] 因为嫌 Quicker 限制多且收费,我用业余时间写了款免费开源的 Windows 效率神器 [开源分享] RPG Roleplay Platform:把你收藏的小说变成可交互游戏世界的自托管 LLM 引擎 [开源] 告别“删库跑路”的恐惧:我做了一款跨平台的磁盘清理工具 Skiff [开源] 一个支持自定义管理 github star 页的浏览器插件 [Github 开源] 个人自托管、零运维的 A 股「选股 + 监控 + 回测」智能量化工作台 [开源] 嘴遁 TalkOut: AI 斗嘴游戏 用一张嘴说服一个死活不松口的 AI 开源了一个自托管的 Agent 编排项目,不想再用拖拽画工作流了
我做了一个 Agent Team 协作平台——Rudder:让 Agent Team 在...
Zeeland4v · 2026-05-27 · via 开源软件

最近在开发 Rudder ,一个给重度 agent 用户使用的 Agent Team 协作平台。

项目地址:

如果你已经在高频使用 Codex 、Claude Code 、Cursor ,或者已经开始维护自己的 Agent Skill ,Rudder 解决的是下一阶段的问题:

Agent 不只是完成任务,还能在真实任务、review 和 feedback 里持续迭代自己的能力。

Rudder 把 goals 、issues 、agent runs 、reviews 、feedback 、skills 和 learning 串成一个 work loop 。一次 agent run 结束后,不只留下 transcript ,还会留下可追踪、可 review 、可沉淀、可回滚的学习记录。

我自己现在高频用 Codex 、Claude Code ,也开始大量使用 Agent Skill 。单次执行已经很强。改代码、查 API 、写说明、修 CI ,这些都能做。很多 know-how 也确实可以沉淀下来。

但用久了以后,麻烦的是这些问题:

  • 什么应该变成 memory ?
  • 什么应该变成 skill ?
  • 什么只是这次任务的一次性约束?
  • 什么应该留在当前 issue 里?
  • 什么根本不该沉淀?

一些可能的情况:一条 review feedback 可能是团队长期原则,也可能只是这次任务的临时要求。一个成功经验可能值得沉淀成 skill ,也可能只适合留在这次任务里。一个 skill 被启用以后,也不代表它真的让 agent 做得更好。它可能误触发,可能拿错 source of truth ,可能增加上下文成本,也可能把旧判断带回新任务。

在这个基础上,Rudder 是 agent team 在实践中成长的运行层:一边推进真实工作,一边把团队的流程、偏好、判断标准和 skill usage 变成可复用的能力资产。

举个例子

比如一次 release 任务失败了。

普通 agent 工具可能最后留下 transcript 、错误日志和一句总结:“下次发布前要更小心。”

这句话没什么用。

Rudder 会更关心这些东西:

  • 这次 issue 的目标是什么。
  • agent 执行时加载了哪个 release skill 。
  • 它查了哪些 source of truth ,比如 tag 、registry 、CI run 。
  • reviewer 为什么退回。
  • 这次失败暴露的是 skill 的触发问题、流程问题,还是 source 读取问题。
  • 这条经验是否值得变成 skill update 。
  • 更新后,下次类似 release 是否减少返工。
  • 如果没有改善,能不能回滚这次 skill update 。

这样一次失败就不是“又失败了一次”,而是 agent team 的一次训练样本。

和 GitHub Issues + Claude Code + 一堆 Skill 有什么区别?

这个问题很关键。因为我自己也在用这些东西。

GitHub Issues / Linear 能管理任务,但它们不太关心 agent 在这次任务里学到了什么。

Codex / Claude Code 很适合执行任务,但 run 结束后,feedback 、review 、失败模式和 skill 更新很难自然进入下一次工作。

Agent Skill 能沉淀经验,但 skill 本身也会变成问题:

  • 什么时候应该触发这个 skill ?
  • 这次触发是不是误触发?
  • 它有没有先拿对 source of truth ?
  • 它有没有真的降低返工?
  • 它是不是只是把一次性偏好写成了长期规则?
  • 它变差以后能不能回滚?

Rudder 把这些 agent 的执行过程放进一个可追踪、可 review 、可沉淀、可回滚的工作循环里。

欢迎试用、star 和提 issue

Rudder 还在快速迭代中,欢迎大家提供反馈!

github.com

如果你也在重度使用 agent ,欢迎试用、star ,或者直接拿自己的 agent workflow 来挑战这个设计。

欢迎大家反馈,最后也想听听大家的讨论!

  1. 你平常开发的时候用的 Agent Skill ,主要是自己搭建的,还是去网上找好用现成更多?
  2. 你如何评价自己平常使用的 agent skill ,会去跑 evaluation 吗?
  3. Agent Skill 多了以后,你们如何处理 skill 越写越长、越写越乱、过度收敛的问题?
  4. 你们现在怎么判断一条 feedback 应该进 memory 、skill 、workflow ,还是只留在当前 issue ?
  5. 你们会不会想知道某个 skill 到底有没有让任务成功率变高?
  6. 如果一个工具能记录 run 、review 、learning proposal 、skill update 、eval 和 rollback ,你会觉得这是刚需,还是过度设计?