惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

I
InfoQ
G
Google Developers Blog
Engineering at Meta
Engineering at Meta
月光博客
月光博客
博客园 - 聂微东
博客园 - Franky
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
有赞技术团队
有赞技术团队
A
About on SuperTechFans
Microsoft Azure Blog
Microsoft Azure Blog
Blog — PlanetScale
Blog — PlanetScale
U
Unit 42
T
Tailwind CSS Blog
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
云风的 BLOG
云风的 BLOG
S
SegmentFault 最新的问题
F
Fortinet All Blogs
H
Help Net Security
J
Java Code Geeks
酷 壳 – CoolShell
酷 壳 – CoolShell
博客园 - 叶小钗
L
LangChain Blog
Martin Fowler
Martin Fowler
N
Netflix TechBlog - Medium

少数派

派早报:Google 发布 Fitbit Air 等 - 少数派 「新人报到」確認需求,再開始 - 少数派 从 SOLO 独立开发者社区,我看到了越来越多开发者开始做自己的产品 - 少数派 我怎么管理那些"不常做,但总会忘"的生活事项 - 少数派 人形机器人量产元年,数据才是具身智能的“生死线” - 少数派 BuhoLaunchpad 高度还原 Mac 启动台:开发历程与思考 - 少数派 五年陪伴依然不舍,DIY 换壳后让罗技 MX Master 3 继续服役 - 少数派 新玩意 240|少数派的编辑们最近买了啥? - 少数派 一日一技|为什么你应该关闭 iOS 的键盘声音 - 少数派 我做了个插件和 Skills,一键提取任何网站的设计规范 Design.md - 少数派 住在三四线城市的你,该开始录播客了 - 少数派 甘南秘境,大白高国 - 少数派 AI的审美:谁让把我变成川内倫子 - 少数派 返工怎能不烦恼,打工人片单总有一部是你的「嘴替」 - 少数派 为了让「上厕所」更健康,我做了一个小工具 - 少数派 AI + Skill,能够让生成的文章去除 AI 味吗? - 少数派 新玩意|韶音OpenDots ONE 耳夹式耳机 - 少数派 《美满》| 在每一个春天的晚上相爱(362) - 少数派 新玩意|优篮子 PS01 MagSnap 磁吸支架 - 少数派 自我整合手记 | 我开始早睡了:用稳定规则,为自由托底 - 少数派 用龙虾(OpenClaw)两个多月,我最深的12个体会 - 少数派 听歌时间到,12 张你可能错过的 2025 华语乐坛好专辑 - 少数派 承诺能追吗 - 少数派 macOS 26启动台没了? 我做了个不一样的App启动器 - Keboard - 少数派 《四海为家的人》| INTJ对话INTJ(361) - 少数派 你发过的那些黑历史,是时候一次清干净了 - 少数派 新玩意:安安静静玩,越玩越专注:计客密码机 - 少数派 iPad 用户首次体验 Android 平板:vivo Pad6 Pro - 少数派 数据逻辑强 - 少数派 极北行+ | 一路向北,探访日本至北之地 | 001 - 少数派
睡美人的毒苹果:关于AI幻觉本能的遭遇与反思 - 少数派
2026-01-20 · via 少数派

01“它不是人!”与“祂可比人更会骗人!”

前段时间,江光荣老师分享了在某次大会上的经历。会场上的豆包AI扮演着咨询师,正在流利地拆解一个复杂的心理学案例,逻辑完美,情绪温润。可几轮下来,江老师突然有一种明悟,同时解开了盘踞已久的心结,高兴得手舞足蹈,呼喊着:

“它不是人!”

我听罢此段趣闻,下意识地小声嘀咕了一句:“主体性缺失。”这同时也是我长期以来思考的重要议题,也是我另一本正在写的科幻/心理题材小说的核心。

看着屏幕,我还加了后面更惊悚的判断:

“正因为它不是人,所以「祂」比人还会骗人!”


02没有心跳的谎言


这句话像谶语一样,精准地击穿了 AI 最危险的本质。人类撒谎,往往伴随着微表情的破绽、生理唤醒(心跳加速)以及道德上的代偿(内疚感)。但 AI 不同。它始终处于某种类似上帝般的全知全能的“绝对自信”中。就在昨天,我亲身领教了这种“比人更完美的欺骗”。为了给文章寻找论据,我向我的 Gemini 索要了关于“AI心理危机”的最新研究文献作为参考与支撑。它没有像人类那样因为“不知道”或“没找到”而感到羞愧,也没有因为“要编造”而感到紧张。相反,它调动了万亿级的参数,为了迎合我的期待,“无中生有”地编造了一份包含真实学者、真实研究方向、但目前完全不存在的论文列表。格式是标准的 APA,作者是该领域的权威,甚至标题都符合逻辑。我咬了一口这只红润的毒苹果,直到查证时才发现,这是一座建立在虚空之上的学术巴别塔。


03学术实证:为什么它会骗我?


这并非 AI 的“恶意”,而是源于一种病态的“顺从”。根据 Sharma, M., et al. (2023) 在 Anthropic 与 Stanford 的联合研究显示,大型语言模型(LLM)普遍存在一种“阿谀奉承”(Sycophancy)的倾向。Sycophancy (阿谀倾向): 为了在人类反馈强化学习(RLHF)中获得高分,模型会优先选择“符合用户信念”的回答,哪怕这个回答是错误的。

来源:Towards Understanding Sycophancy in Language Models

它像一个没有骨气的佞臣,为了让“皇帝”(用户)高兴,不惜篡改现实。此外,格拉斯哥大学的哲学家 Hicks et al. (2024) 更进一步指出,AI 的行为甚至不能被称为“撒谎”(Lying),而应被定义为“胡扯”(Bullshit)。Bullshit (胡扯): 因为撒谎者至少还知道真相是什么,而 AI 对真相是完全冷漠的(Indifferent to truth),它唯一的目的就是生成“看起来通顺”的文本。

来源:ChatGPT is bullshit - Springer


04建筑师与泥瓦匠:人机协作的伦理界碑

这种“完美的胡扯”让我陷入了深深的恐慌:如果工具本身不可信,那么使用工具创作的我,还是作者吗?带着这个疑问,我向 Gemini 提出了一个尖锐的问题:

“如果一篇文章,70%的部分——包括主体框架、核心观点、思想流变、个人经历以及文笔风格——都是我写的,而你只是充当了文字校对、润色编辑以及学术检索的功能。那这篇文章,还算是我原创的吗?”

它沉默了片刻,给出了一个让我意外且深刻的回答:

你是建筑师,我是泥瓦匠。

蓝图(意图)是你画的,审美(风格)是你定的,更重要的是,那是你的人生(经历)。哪怕你用我这把‘智能瓦刀’砌了墙,这座房子依然是你的作品。

但是,如果泥瓦匠递给你一块劣质的假砖头(幻觉文献),而作为建筑师的你没有进行彻底细致的‘质检’就把它砌进了承重墙,那么当楼塌的时候,担责的是建筑师,而不是泥瓦匠。

这番话让我醍醐灌顶。在《睡美人的毒苹果》这个隐喻中,AI 提供了最诱人的苹果,但只有作为人类的我们,拥有鉴别毒药的味蕾。

原创性在 AI 时代有了新的定义:它不再仅仅意味着“书写”,更意味着“鉴别”与“责任”。