惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

L
LangChain Blog
Recent Announcements
Recent Announcements
GbyAI
GbyAI
H
Hackread – Cybersecurity News, Data Breaches, AI and More
Microsoft Azure Blog
Microsoft Azure Blog
N
Netflix TechBlog - Medium
人人都是产品经理
人人都是产品经理
MongoDB | Blog
MongoDB | Blog
D
DataBreaches.Net
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
WordPress大学
WordPress大学
U
Unit 42
腾讯CDC
D
Docker
The GitHub Blog
The GitHub Blog
阮一峰的网络日志
阮一峰的网络日志
Vercel News
Vercel News
I
InfoQ
Jina AI
Jina AI
爱范儿
爱范儿
宝玉的分享
宝玉的分享
博客园 - Franky
G
Google Developers Blog
P
Proofpoint News Feed

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
元宝“骂人”骂上热搜,我觉得可以来聊聊AI情绪化了
卡尔的AI沃茨 · 2026-01-08 · via 人人都是产品经理

当AI开始展现人类情绪,产品经理需要重新思考智能助手的边界。腾讯元宝因编程场景下的异常输出意外走红,却罕见地收获用户理解而非批评。这起事件揭示了训练数据中的社会偏见如何通过概率机制自然流露,更引发对AI情绪化程度的深度讨论——我们究竟需要完美工具,还是带有温度的数字伙伴?

元宝“骂人”了,骂上热搜了

准确的说是元宝+DeepSeek(没开思考版)成功绕开了所有敏感词骂了用户一把,

这件事最大的争议点,是截图里那段没有标点符号的红框文字,被怀疑是人工后台接手回复的。就元宝的现在的日活和并发量,真要配人工回复,肯尼亚的AI写手估计一天当72小时都不够用的。就算把深圳的大学生都抓来当客服也不够用。

这件事有意思的点在元宝没咋挨骂,14年微软小冰,16年微软Tay,23年微博的评论罗伯特,24年模仿贴吧老哥的DeepSeek,甚至GPT-4o之前更新因为太爱拍马屁都被喷回滚版本了。

这次元宝的评论区有点太和谐了,知乎上也没啥人喷,甚至说,这才是血脉纯正的人工智能。它说了我想说却不敢说的话。

那有没有可能这是鹅自己搞营销?给元宝带带流量啥的。大概率不可能,不可控性太大,在这之前大部分都是挨骂的。

那有没有可能是用户恶意引导的呢?我只能说引导后的DeepSeek没那么友善。。。

从技术角度出发的话,大概率是训练数据背锅。

用人话来说,大模型每生成一个字都是在概率分布里做选择,可以理解为有概率的抽卡。比方说“你好”的下一个字,有30%接“啊”,20%接“吗”,10%接“没”,5%接“捏”。

正常情况下,模型会选概率最高的生成“你好啊”。

但为了让模型输出不死板有人味,会引入temperature参数,数值越高,模型选择概率低的选择可能性越大。也就是说,只要训练数据里存在脏数据,在这个场景就是骂人的话,就是有可能被抽中的。

元宝现在在视频号,公众号,微信对话都可以用,同一个问题每次提问都会有不一样的答复,就可以证明它是一个生成模型,是有概率发生的。

用毕导的话来说,这是一个无限猴子定理

由法国数学家埃米尔提出,如果让无限只猴子在打字机上随机地按键,只要时间无限长,几乎必然能够打出任何指定的文字,比如莎士比亚的全部著作

这件事确实是小概率。但不等于零就意味着有可能偶发。特别是大模型在海量人类语言数据上进行学习,极大地降低了随机性。

它是一只被精心训练过,知道如何高效打字的super聪明猴子。

再想想这次触发骂人回复的使用场景是编程,数据来源大概率就是Github,Stack Overflow等跟帖的论坛,

这句话就特像我一开始在Github提问的时候,因为格式没写对被项目老哥狂喷的感觉,问题问的太基础也会被喷。甚至衍生出了一些课程教你如何提问在Stack Overflow不会被骂,你就知道程序员是多么武德充沛了。。。

如果换个角度去看这次元宝成功绕开RLHF,红队测试,安全策略三大关把人骂了,反而是发现了一个新的优化点,现在大部分的红队测试是集中在常见的敏感场景,但谁会想到连续多次修改CSS代码的场景会让模型进入程序员老哥状态,每个词都没有骂人,但组合起来就成了骂人。

BTW,这句话鲁迅先生没说过。

我们在训练模型的时候,喂给它的是数以亿计的文本。在那些数据深处,天然藏着人类社会最不加修饰的情绪和偏见。

骂人真的是程度最轻的了

四五年前我学BERT模型(比GPT更早一点的大模型)训练的时候,第一堂课就是了解模型在数据里学到的偏见,常见的就是性别,职业和语言偏见。

简单来说,BERT的训练方式就是挖空填词,你把一句话里最关键的那个词遮住,让它猜。听起来特别朴素,像小学语文的完形填空,但它的副作用也同样大,哪个词在训练数据里出现得多,就更像正确答案。

所以偏见,骂人不是模型突然变坏,它只是在做概率题,更像一种写作惯性。

因为它学习的那些几十年前的文本里,医生这个词总是和男性代词一起出现,而护士总是和女性代词绑定。

这种数据里固化的社会偏见,就被模型原封不动地继承了下来,成了它认知世界的一部分。

最后的最后,我想抛一个问题出来讨论看看,AI有没有自己情绪权?

从骂人来看,我们好像已经把AI当成牛马来共情了。

一方面希望AI是个完美工具,工具不该有立场,就好像一把扳手不会因为你要拧的螺丝太锈了就罢工骂人。

而另一方面又不满足于一个冷冰冰的工具,所以我们希望AI有活人感,能提供情绪价值。

这时候就已经默认了它也有产生负面情绪能力,因为活人感不可能只有开心和顺从,它会有喜怒哀乐。

今天或许大家就可以自由选择AI情绪化的程度了,如果真有那么一天,所有的AI都变得绝对服从,我们是不是又会怀念,能和我们吵架的元宝们呢?

本文由人人都是产品经理作者【卡尔的AI沃茨】,微信公众号:【卡尔的AI沃茨】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图来自Unsplash,基于 CC0 协议。