惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

WordPress大学
WordPress大学
V
V2EX
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
Jina AI
Jina AI
小众软件
小众软件
量子位
博客园 - 三生石上(FineUI控件)
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
酷 壳 – CoolShell
酷 壳 – CoolShell
博客园 - Franky
博客园_首页
IT之家
IT之家
S
SegmentFault 最新的问题
博客园 - 叶小钗
阮一峰的网络日志
阮一峰的网络日志
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
博客园 - 聂微东
T
Tailwind CSS Blog
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
爱范儿
爱范儿
月光博客
月光博客
有赞技术团队
有赞技术团队
H
Help Net Security
云风的 BLOG
云风的 BLOG

少数派

派早报:Google 发布 Fitbit Air 等 - 少数派 「新人报到」確認需求,再開始 - 少数派 从 SOLO 独立开发者社区,我看到了越来越多开发者开始做自己的产品 - 少数派 我怎么管理那些"不常做,但总会忘"的生活事项 - 少数派 人形机器人量产元年,数据才是具身智能的“生死线” - 少数派 BuhoLaunchpad 高度还原 Mac 启动台:开发历程与思考 - 少数派 五年陪伴依然不舍,DIY 换壳后让罗技 MX Master 3 继续服役 - 少数派 新玩意 240|少数派的编辑们最近买了啥? - 少数派 一日一技|为什么你应该关闭 iOS 的键盘声音 - 少数派 我做了个插件和 Skills,一键提取任何网站的设计规范 Design.md - 少数派 住在三四线城市的你,该开始录播客了 - 少数派 甘南秘境,大白高国 - 少数派 AI的审美:谁让把我变成川内倫子 - 少数派 返工怎能不烦恼,打工人片单总有一部是你的「嘴替」 - 少数派 为了让「上厕所」更健康,我做了一个小工具 - 少数派 AI + Skill,能够让生成的文章去除 AI 味吗? - 少数派 新玩意|韶音OpenDots ONE 耳夹式耳机 - 少数派 《美满》| 在每一个春天的晚上相爱(362) - 少数派 新玩意|优篮子 PS01 MagSnap 磁吸支架 - 少数派 自我整合手记 | 我开始早睡了:用稳定规则,为自由托底 - 少数派 用龙虾(OpenClaw)两个多月,我最深的12个体会 - 少数派 听歌时间到,12 张你可能错过的 2025 华语乐坛好专辑 - 少数派 承诺能追吗 - 少数派 macOS 26启动台没了? 我做了个不一样的App启动器 - Keboard - 少数派 《四海为家的人》| INTJ对话INTJ(361) - 少数派 你发过的那些黑历史,是时候一次清干净了 - 少数派 新玩意:安安静静玩,越玩越专注:计客密码机 - 少数派 iPad 用户首次体验 Android 平板:vivo Pad6 Pro - 少数派 数据逻辑强 - 少数派 极北行+ | 一路向北,探访日本至北之地 | 001 - 少数派
Open AI重磅论文:不会胡说八道的大模型不是好的大模型 - 少数派
2026-01-17 · via 少数派

最近Open AI 发布了一个重磅论文,揭秘了AI为什么会胡说八道,AI幻觉这个问题从理论层面得到了系统性的解释。这个论文可能会改变整个AI产品的设计思路甚至重塑整个AI模型的评测标准。此前我们普遍认为,随着技术迭代(如模型参数升级、算法优化),AI 幻觉会逐步缓解。但即便上月 GPT-5 发布,面对部分问题时,AI “一本正经说假话” 的现象仍未消失。而这篇论文抛出了一个颠覆认知的核心结论:校准性能优异的大模型,必然伴随幻觉;完全 “不胡说八道” 的模型,反而存在校准缺陷 —— 从技术层面看,这类模型并非优质大模型
 

为什么说不会胡说八道的模型不是好的模型,背后的原因也很简单:就是AI大模型在训练他的过程中就是鼓励它去猜测鼓励它去推理胡说八道,而不是让它承认它不知道它有些东西不确定。所以这压根不是一个技术的问题,而是一个系统性的问题,你技术越好这个AI大模型就越善于猜测,它就越有可能给一个胡说八道的答案。是它的训练方式中的评分淘汰机制,这就决定了如果它不胡说八道,就像一个学生写试卷,如果它不写就是零分,但是它写了它还可能得到点分数,不然它就是要被人类打分后淘汰的。

所以如果这个AI的训练方式改变了,那么可能以后我们再问他答案它会直接告诉我们不知道,而不是强行捏造出来一个答案。根据论文里的信息给大家几个建议,在新的AI到来之前可以更好的训练AI,尽可能的降低AI的幻觉率,不让他胡说八道。

这几个建议可以添加到你给大模型的prompt的最后,作为减少幻觉的提示词优化:

1.只有在你非常确定这件事的情况下,才会告诉我这个信息,否则直接告诉我你不知道。(你问的时间,地点,人物等)

2.如果你知道的话你就告诉我,如果你的信息来源不是很可靠那你可以把信息来源告诉我,并且告诉我可靠程度是多少?

3.(在你给AI一个不可靠的回答的时候)你对当前问题的答案进行可行度评级:如实告诉我你对这个答案是非常确定,比较确定,不太确定还是基本靠猜测。

4.这个数据在你的训练数据中出现过几次?如实告诉我。

5.采用分层回答形式:将 “高度确定的信息” 与 “不确定的信息” 明确拆分呈现,避免混为一谈。

6.相较于提供可能出错的答案,我更希望你在面对不确定信息时,直接告知 “不知道”。