惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

G
Google Developers Blog
宝玉的分享
宝玉的分享
月光博客
月光博客
B
Blog
云风的 BLOG
云风的 BLOG
Google DeepMind News
Google DeepMind News
Engineering at Meta
Engineering at Meta
aimingoo的专栏
aimingoo的专栏
N
Netflix TechBlog - Medium
博客园_首页
GbyAI
GbyAI
人人都是产品经理
人人都是产品经理
A
About on SuperTechFans
Y
Y Combinator Blog
L
LangChain Blog
有赞技术团队
有赞技术团队
D
Docker
爱范儿
爱范儿
博客园 - 司徒正美
H
Hackread – Cybersecurity News, Data Breaches, AI and More
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
酷 壳 – CoolShell
酷 壳 – CoolShell
Microsoft Security Blog
Microsoft Security Blog
D
DataBreaches.Net

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
幻觉问题的源头——“应试教育”正在让AI给我们带来错误
一葉 · 2025-09-19 · via 人人都是产品经理

AI老是一本正经地胡说八道?这篇文章讲透一个冷门但扎心的原因:我们教AI的方式,其实就是“应试教育”,它学会了套路,却没学会思考。

AI的幻觉

所谓AI“幻觉”(Hallucination),是指AI会给出看似有理有据却全然错误的回答的现象,也就是我们俗称的“一本正经地胡说八道”。关于AI“幻觉”的具体表现,我在之前文章的基础上,进一步总结为两类情况。

  • 无中生有:即AI会在既有事实的基础上,进行过度的推断,进而编造一些虚假的信息。
  • 张冠李戴:即AI会将两样并无关系的事物建立联系,比如将甲所做的事情安到了乙身上。

OpenAI 最新论文《Why Language Models Hallucinate》告诉了我们幻觉的由来,也提出了一种解决办法。

AI幻觉是在“预测”不是在理解,这是统计学的必然

AI会产生“幻觉”的源头,就在于AI的运作原理。

如今所有的生成式AI,即运作的本质都是“密度估计”,即通过前期训练建立语料之间的关联,不断地预测在给定的语境中下一个字词是什么的概率规律。而所有AI的设定,都是“尽可能满足用户要求”。

密度估计(Density Estimation)是机器学习与统计学的核心任务之一,其目标是从有限的观测数据中,推断出产生这些数据的未知概率分布的形状。简单来说,它回答了 “数据在各个取值区间上出现的可能性有多高” 这一问题,最终输出一个能描述数据分布规律的 “概率密度函数(Probability Density Function, PDF)”。

这就导致了,当用户对AI提出要求,AI又的确没有相关资料,可它的设定又要求AI必须“说点什么”,尝试去给出一个回答,此时就有可能出现“无中生有”或“张冠李戴”的“幻觉”现象。

幻觉的根源:训练机制——评测体系在“奖励胡说”

“语言模型就像在考试中猜答案的学生。”

如果你在考试中写“我不知道”,得分是0;

而猜一个答案,哪怕错了,也有概率猜对得分。

现有的主流评测基准(如 MMLU、GPQA、SWE-bench等)几乎全部采用二元评分制

  • 对 = 1分
  • 错或IDK = 0分

这就导致模型宁愿“蒙一个”也不愿说“我不知道”。

就像一个考试希望得高分得学生,碰到我不会的选择,我可以蒙啊,蒙到就是赚到。

论文统计了10个主流评测基准,发现:

只有 WildBench 对“不确定”有部分给分,其他一律零分。

训练机制决定幻觉倾向,大多数模型的训练唯一目标是最大化下一个词出现的概率,而不是核查事实。这种机制天然就倾向于生成“似是而非”的内容。

强化学习的学习范式,主要的监督信号就是最终结果是否正确。而大模型本身的推理过程,尤其是数学题那种多步推理,是一个非常长的多步决策过程。但强化学习比如 GRPO( 一种强化学习算法 )只在最后一步给出奖励,就可能导致模型学到的最终结果是正确的,但中间的推理过程是错误的。模型可能会发展出一些错误但高效的策略,这就是所谓的 ‘ 幻觉 ’ 现象的来源。”

解决幻觉办法

如何最大限度减少 AI 幻觉?

其实这个是业界和学界也都一直在探究的目标

目前的策略可能更多是偏向于以下的几种方法:

  • 检索增强生成(RAG):给模型增加一个“查资料”模块,让它回答前先查外部数据库或网页;
  • 插件与联网设计:如WolframAlpha(做计算)和BingSearch插件(查新闻)已集成至GPT产品中,提升事实查验能力;
  • 多阶段生成机制:将“任务理解、信息检索、生成内容”分阶段执行,避免一次性完成的单步误导;
  • 专业模型精调:在医学、金融、法律等专业领域,训练专门子模型来提供更安全、准确的答案。

而在论文中提到了,明确“置信度阈值”

当前大多数语言模型评估(如MMLU、GPQA、SWE-bench等)采用二元评分(binary grading):正确答案得1分,错误或IDK都得0分。这种评分方式鼓励模型在不确定时也进行猜测,因为猜对了能得分,而IDK则一定不得分。

为了解决这个问题,在评估指令中明确说明一个置信度阈值,并据此调整评分规则,使得模型在置信度低于阈值时,选择IDK才是最优策略。

意思就是让模型:

“仅当你置信度大于阈值时才回答,因为错误答案会被扣分,正确答案得1分,回答‘我不知道’得0分。”

与传统训练方法相比

这个方法相当具有可行性,相当于让模型的性格会变得更加谨慎,且成熟,而不是像原本的那样,是一个愣头青,胡乱推理猜测。

最后

幻觉是当前LLM的副产物,它既不是“错误”,也不是“欺骗”,而是模型生成机制与真实世界之间的落差,是语言模型当前能力边界的自然结果,而作为一个模型调优的人员,我们要做的是将模型的推理与真实世界去进行对齐,也许这个方法也就是第一步,也是第一个方法。

未来,随着外部工具接入、Agent 机制完善、责任机制明确,幻觉问题会被进一步缓解。但在那之前,任何看起来“说得头头是道”的 AI 回答,我们都应保留验证的习惯,并且合理利用AI的推理,为我们的生活,为我们的工作增加便利。

本文由 @一葉 原创发布于人人都是产品经理。未经作者许可,禁止转载

题图来自Unsplash,基于CC0协议