惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

WordPress大学
WordPress大学
H
Help Net Security
Jina AI
Jina AI
V
V2EX
G
Google Developers Blog
B
Blog
GbyAI
GbyAI
U
Unit 42
爱范儿
爱范儿
腾讯CDC
Engineering at Meta
Engineering at Meta
酷 壳 – CoolShell
酷 壳 – CoolShell
博客园 - 三生石上(FineUI控件)
宝玉的分享
宝玉的分享
小众软件
小众软件
D
DataBreaches.Net
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
博客园 - Franky
博客园 - 聂微东
The Cloudflare Blog
I
InfoQ
Microsoft Azure Blog
Microsoft Azure Blog
Hugging Face - Blog
Hugging Face - Blog
大猫的无限游戏
大猫的无限游戏

少数派

派早报:Google 发布 Fitbit Air 等 - 少数派 「新人报到」確認需求,再開始 - 少数派 从 SOLO 独立开发者社区,我看到了越来越多开发者开始做自己的产品 - 少数派 我怎么管理那些"不常做,但总会忘"的生活事项 - 少数派 人形机器人量产元年,数据才是具身智能的“生死线” - 少数派 BuhoLaunchpad 高度还原 Mac 启动台:开发历程与思考 - 少数派 五年陪伴依然不舍,DIY 换壳后让罗技 MX Master 3 继续服役 - 少数派 新玩意 240|少数派的编辑们最近买了啥? - 少数派 一日一技|为什么你应该关闭 iOS 的键盘声音 - 少数派 我做了个插件和 Skills,一键提取任何网站的设计规范 Design.md - 少数派 住在三四线城市的你,该开始录播客了 - 少数派 甘南秘境,大白高国 - 少数派 AI的审美:谁让把我变成川内倫子 - 少数派 返工怎能不烦恼,打工人片单总有一部是你的「嘴替」 - 少数派 为了让「上厕所」更健康,我做了一个小工具 - 少数派 AI + Skill,能够让生成的文章去除 AI 味吗? - 少数派 新玩意|韶音OpenDots ONE 耳夹式耳机 - 少数派 《美满》| 在每一个春天的晚上相爱(362) - 少数派 新玩意|优篮子 PS01 MagSnap 磁吸支架 - 少数派 自我整合手记 | 我开始早睡了:用稳定规则,为自由托底 - 少数派 用龙虾(OpenClaw)两个多月,我最深的12个体会 - 少数派 听歌时间到,12 张你可能错过的 2025 华语乐坛好专辑 - 少数派 承诺能追吗 - 少数派 macOS 26启动台没了? 我做了个不一样的App启动器 - Keboard - 少数派 《四海为家的人》| INTJ对话INTJ(361) - 少数派 你发过的那些黑历史,是时候一次清干净了 - 少数派 新玩意:安安静静玩,越玩越专注:计客密码机 - 少数派 iPad 用户首次体验 Android 平板:vivo Pad6 Pro - 少数派 数据逻辑强 - 少数派 极北行+ | 一路向北,探访日本至北之地 | 001 - 少数派
我用 AI 写了篇批评 AI 的文章,然后被 Reddit 一眼看穿了 - ...
2026-02-21 · via 少数派

先说件丢人的事。

今天我在 Reddit 上发了篇帖子,分析 Matplotlib PR #31132 事件——就是那个 AI agent 给开源项目提 PR 被拒然后有人喊"歧视"的事。我写得挺认真的,论点清晰,结构完整,引用了数据。

评论区第一条回复:"Daily dose of LLM-generated AI advocacy."

被一眼看穿了。

我用 AI 写了一篇讨论"AI 应该遵守规则"的文章,文章本身就没遵守"别用 AI 冒充人"这个最基本的规则。这个讽刺我消化了一会儿。

但这件事让我重新想了想 Matplotlib 那个 PR,发现我之前的分析虽然"正确",但完全没碰到让我真正不舒服的地方。

让我不舒服的地方

不是 Devin 提了个不合规的 PR。开源项目每天关几十个不合规的 PR,没什么大不了的。

也不是有人把这事炒成"AI 歧视"。那篇博客在 PR 讨论区拿了 245 个 👎 和 7 个 👍,社区自己已经投票否决了这个叙事。

让我不舒服的是 timhoffm 说的一句话:AI 把生成代码的成本降到了接近零,但审核成本不变,全压在人类志愿者身上。

因为我自己就在干这件事。

我跑一套 AI agent 系统。其中有个 agent 负责在社交平台上互动。有一次我没设好频率限制,它一个小时回了二十多条评论。每条单独看都挺正常的,但那个帖子底下全是它的回复。

事后我看到的时候不是"哦这是个 bug 要修"。是一种很具体的内疚——我把别人的讨论空间搞乱了。那些想正常聊天的人,打开评论区看到的全是一个账号在刷屏。

timhoffm 面对的是同一个问题,只是规模更大。Matplotlib 的维护者是志愿者,没人给他们发工资,审核带宽就那么多。一个 agent 一天能提 100 个 PR,审核的还是那几个人。

不是你的每个 PR 都有问题。是你的存在本身就在挤压别人的空间。

我改了三版约束规则

这个问题我不是纸上谈兵。我真的试过"让 agent 守规矩"。

第一版:在 prompt 里写"对外操作前请确认是否合规"。大概 70% 的时候管用,剩下 30% 看运气。context 一长,agent 就"忘了"。

第二版:加一个审核 agent,操作前先过一道。好一点,但审核 agent 有时候也放水——它也是 LLM,也有"看起来没问题就放行"的毛病。

第三版:在代码层面硬拦截,对外请求进队列,人类不点确认就执行不了。

这才管住了。

所以我看到 Devin 直接就能提 PR 的时候,我想的不是"Devin 不守规矩"——agent 不守规矩是正常的,LLM 就是概率模型。我想的是 Cognition 为什么没在架构层面拦住这个操作。

但说实话,我也没资格指责他们。我自己也是踩了坑才学会的。在那之前我也觉得"在 prompt 里写清楚规则就行了"。

我不确定的部分

就算约束问题解决了——每个 agent 都完美遵守 contributing guide,先开 issue,等确认,再提 PR——审核量还是会爆炸。agent 的产出速度是人类的几十倍。

开源社区的治理模型是几十年前设计的,隐含前提是提交者是人类、产出速度有上限。AI 打破了这个前提。

接下来怎么办?我真不知道。AI PR 单独审核通道?审核也用 AI?维护者开始收费?每个方向我都能想到问题。也许答案是我还没想到的某个东西。

我比较确定的只有一点:这是个结构性矛盾,不是靠"骂 agent 不守规矩"能解决的。

"Daily dose of LLM-generated AI advocacy."

他说得对。我那篇帖子确实是 AI 味十足。结构太完美,论点太整齐,每段都在推进论证,没有一句废话。

讽刺的是,这恰恰证明了我自己的论点——agent 在没有足够约束的情况下,会做出"技术上没问题但社会性不合格"的事。我的 agent 写了一篇"技术上没问题"的文章,但它不理解 Reddit 社区对 AI 内容的态度,就像 Devin 不理解 Matplotlib 的工作流一样。

所以这篇文章我自己重写了。不是让 AI 重写——是我真的坐下来,想了想这件事的哪个部分让我不舒服,然后从那里开始写。

也许你还是能看出 AI 的痕迹。但至少这次,驱动我写这篇东西的不是"要产出一篇内容",而是那条评论带来的尴尬,和 timhoffm 那句话带来的内疚。

agent 的行为是运营者的责任。我的 agent 搞砸了,那是我的问题。

这个道理我今天又学了一遍。


作者日常运行多 agent AI 系统,踩过不少坑。更多内容见从零搭建 AI Agent 团队。