惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

V
Vulnerabilities – Threatpost
博客园 - 司徒正美
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
大猫的无限游戏
大猫的无限游戏
酷 壳 – CoolShell
酷 壳 – CoolShell
Forbes - Security
Forbes - Security
D
Darknet – Hacking Tools, Hacker News & Cyber Security
小众软件
小众软件
人人都是产品经理
人人都是产品经理
Know Your Adversary
Know Your Adversary
Security Latest
Security Latest
雷峰网
雷峰网
Cisco Talos Blog
Cisco Talos Blog
Latest news
Latest news
GbyAI
GbyAI
Last Week in AI
Last Week in AI
Hacker News: Ask HN
Hacker News: Ask HN
U
Unit 42
S
SegmentFault 最新的问题
月光博客
月光博客
Security Archives - TechRepublic
Security Archives - TechRepublic
Attack and Defense Labs
Attack and Defense Labs
S
Secure Thoughts
N
News and Events Feed by Topic
Exploit-DB.com RSS Feed
Exploit-DB.com RSS Feed
A
Arctic Wolf
Schneier on Security
Schneier on Security
C
CERT Recently Published Vulnerability Notes
I
Intezer
V
Visual Studio Blog
Microsoft Security Blog
Microsoft Security Blog
SecWiki News
SecWiki News
Google Online Security Blog
Google Online Security Blog
N
Netflix TechBlog - Medium
I
InfoQ
T
Tor Project blog
腾讯CDC
T
Tenable Blog
Webroot Blog
Webroot Blog
Y
Y Combinator Blog
TaoSecurity Blog
TaoSecurity Blog
Google DeepMind News
Google DeepMind News
AI
AI
C
Cisco Blogs
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
V2EX - 技术
V2EX - 技术
PCI Perspectives
PCI Perspectives
C
CXSECURITY Database RSS Feed - CXSecurity.com
G
GRAHAM CLULEY
S
Schneier on Security

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理, 企事业单位数字化的业务供需本质 – 人人都是产品经理, 医疗智能体·第1讲——医疗信息化重构:从“辅助软件”到“自主智能体”的范式转移 – 人人都是产品经理, 粉丝量就是空气!!! – 人人都是产品经理, 用户说“薯片碎了”,机器回“要买吗?”:意图识别的翻车与破局 – 人人都是产品经理, RAG召回准确率从75到90 我做对了这三件事 – 人人都是产品经理, AI大事件:Anthropic改收费、OpenAI发安全版、手术机器人纳入医保、阿里发布”秒悟” – 人人都是产品经理, Chrome 推出 Skills 新功能,Agent 重塑上网方式 – 人人都是产品经理, GitHub前创始人拿了a16z的1700万美元,做Agent时代的Git – 人人都是产品经理 拷贝或克隆其他 Flutter OH 项目到本地后无法运行 – 人人都是产品经理, 优惠券设计:优惠券创建 – 人人都是产品经理, 不用死磕文档!AI 助手 1 小时搞定飞书 CLI 安装 + 配置 + 知识库 – 人人都是产品经理, 用小龙虾做竞品分析报告:从2天到20分钟,我是怎么做到的 – 人人都是产品经理 用小龙虾做市场分析报告:搞懂这3个公式,市场规模不再靠猜 – 人人都是产品经理, 你早就在做 Harness 工程,只是不知道它叫这个名字 – 人人都是产品经理, Think Long就够?你可能想多了! – 人人都是产品经理, 货代SRM实战:供应商准入怎么做,才能让资源池不是通讯录而是可交付网络? – 人人都是产品经理, 如何做好用户调研?详解基本技巧 – 人人都是产品经理, 木鸟、途家、美团对打,平台春天行动开“卷” – 人人都是产品经理, 入职才发现公司不靠谱?小红书从业者求职避坑指南 – 人人都是产品经理, 美国 AI 三巨头联手封堵,中国 AI 突围之路在何方 – 人人都是产品经理, 小红书,放在需求对面的镜子 – 人人都是产品经理, AI 会带来大规模失业吗? – 人人都是产品经理, 从出单到补货前,我第一次犹豫:该不该放大? – 人人都是产品经理, Flutter 三方库鸿蒙化适配:5 种高效检查方式,快速判断是否需要适配 – 人人都是产品经理, 从做产品进阶拿结果:医美机构产品经理转岗科室运营经理 – 人人都是产品经理, 阿里HappyHorse,一场关于“Token经济”的阳谋 – 人人都是产品经理, To B AI:客户留存落地的观察与思考 – 人人都是产品经理, AI产品的“生命线”——数据采集、标注、清洗的产品化设计 – 人人都是产品经理, 谈谈AI Agent(二):当“孩子”能自己“体验世界”时,你该学什么? – 人人都是产品经理, UI/UX设计师的3层能力进阶,前两层让你活下来,第三层…才是真正的分水岭 – 人人都是产品经理, 2分钟 → 30秒,效率提升75%:B端产品经理如何用「规则枷锁」驯服AI幻觉? – 人人都是产品经理, 还没来得及学OpenClaw,来了个更猛的:Hermes Agent – 人人都是产品经理, AI日报:宇树机器人跑出10m/s刷新世界纪录 – 人人都是产品经理, 一文说透基金互金如何用情绪价值引导用户决策做转化 – 人人都是产品经理, 当浏览器开始替你”看”网页:AI 浏览器正在亲手拆掉它脚下的那张网 – 人人都是产品经理, 0代码,一天时间我Vibe Coding了个网站 – 人人都是产品经理, Hermes 和 OpenClaw 之争,Agent 的能力应该“装上去”还是“长出来”? – 人人都是产品经理 视频生成的“桌子”,字节Seedance 2掀完,阿里快乐马掀 – 人人都是产品经理, 从听不懂到完全信任:我的 Codex 深度产品体验 – 人人都是产品经理, 当虚拟偶像有了北京户口,与真人偶像还有什么区别? – 人人都是产品经理, 会说,远远比会做更重要 —— 对 SBTI 爆火现象的五层观察 – 人人都是产品经理, AI产品经理必看:当“搭环境”比“选模型”更重要,你的认知还在2024年吗? – 人人都是产品经理, 2026年AI产品商业化核心逻辑:从功能demo到规模化营收的3个必破卡点 – 人人都是产品经理, 京东围绕供应链,卷起裤腿下场的那些事儿 – 人人都是产品经理, SBTI一夜刷屏:它赢在了“太会说人话” – 人人都是产品经理, 折扣零售的真相:不是便宜,而是价值感! – 人人都是产品经理, 和甲方吵了一架,最后加钱做了——我学到的ToB产品经理生存法则 – 人人都是产品经理, 和几位小红书操盘手聊了8小时,干货全在这 – 人人都是产品经理, 智谱GLM-5.1登场,开源模型首超Opus4.6!!! – 人人都是产品经理 Anthropic收入凭什么反超OpenAI,终于有人把这事说清楚了 – 人人都是产品经理, 史上最有故事感的技术报告——Claude最强模型Mythos 7个极其精彩的细节 – 人人都是产品经理, 模型不是壁垒,Harness 也不是 – 人人都是产品经理, 抖音本地生活业务思考21 – 人人都是产品经理, Superpowers:145k Star的AI编码框架,到底是什么来头? Superpowers:145k Star的AI编码框架,到底是什么来头? – 人人都是产品经理, OpenAI 的路走错了,Anthropic Harness 解法启示:模型需要实践专科生 – 人人都是产品经理, 画原型图的前一步:设计站点地图 – 人人都是产品经理, 给 DeepSeek 的最后一封催更信 – 人人都是产品经理, 手把手教你用 Claude Code 搭建 AI 营销团队:5 个 Agent、12 项技能,独立完成研究、写作、设计全流程 – 人人都是产品经理, 你以为大模型在学语言?不,它在重新发明语言学 – 人人都是产品经理 所谓Skill,不过是AI时代的工业垃圾 – 人人都是产品经理, 聊一聊内容传播的几个方法 – 人人都是产品经理, 当平台开始吃掉生态:从 OpenClaw 被封杀,读懂 Anthropic 的这盘棋 – 人人都是产品经理, 你装了 10 个 AI 插件,Obsidian 还是一个文件夹 – 人人都是产品经理 关于AI智能体架构演进的系统性思考:从单体试水到多体协同的重构 – 人人都是产品经理, 当“人”变成Skill,我们又该何去何从? – 人人都是产品经理 Mythos 事件:前沿 AI 治理的意外实验 – 人人都是产品经理, 货代CRM:信用与风险管理怎么做,才能把坏账风险拦在放货之前? – 人人都是产品经理, 从HR收集自拍照到员工自助录入——我见证了园区人脸识别从”不可用”到”真好用”的全过程 – 人人都是产品经理 千问闯关AI混沌期:阿里画靶,吴嘉张弓,马云射箭? – 人人都是产品经理,
最近几个月的AI大模型独立应用实践-3-大模型解决不了一切 – 人人都是产品经理,
markzou · 2026-05-26 · via 人人都是产品经理

大模型并非万能解药,其底层概率机制决定了与生俱来的局限性。从概率模型原理、信息衰减到人类主观因素,本文层层剖析为何GPT、Gemini等AI无法解决所有问题,更揭示知识压缩与采样机制带来的幻觉风险。当技术遇上复杂人性,这场认知革命仍面临根本性挑战。

今天我们来简单聊一个话题——那就是,大模型不能解决一切问题。

这篇文章,我们分三个方面来论证一下,为什么大模型不能解决一切问题。

首先我们将从目前阶段大模型的底层原理来讨论一下。

然后我们从信息的衰减来讨论一下。

最后从人这个角度来讨论一下。

一、目前阶段大模型的底层原理

目前大语言模型的核心原理就是概率学(更准确地说,是一个超大规模的条件概率模型),大模型(如GPT、Claude、Gemini、deepseek、千问等)本质上都在做同一件事

给定一段上文,预测下一个词(token)的概率分布,然后从这个分布中采样出一个词,把它拼到上文里,再预测下一个词……如此循环,生成整段回复。

模型说“太阳从东边升起”时,并不是它“知道”这个天文事实,而是因为在海量文本里,“太阳”和“东边”共现的概率远高于“西边”。整个智能表现,都建立在词语层面的概率关系上。

概率模型产生幻觉的根源有几层:

1、概率高 ≠ 事实正确

模型在训练数据里见过无数“哥伦布发现了美洲大陆”,也见过极少量恶搞或错误文本里写“哥伦布发现了印度”。模型最大化的是“语言上的合理性”,而不是事实准确性。在某些上下文中,一个完全错误但语法通顺的句子概率并不低。

2、知识被压缩成统计印象,没有“真值校验器”

模型内部没有一个事实数据库,也没有一个“这是真的/假的”二值判断模块。所有知识都被压缩在百亿、千亿的参数里,呈现为模糊的关联强度。当你问一个冷门知识,它可能把几个相似但错误的记忆“揉”成一个很像真的答案。

3、长尾知识的概率被稀释

高频事实(比如地球是圆的)概率极高,很难出错。但对于长尾、小众、需要精确匹配的信息(比如某冷门法规的第三款第二条),正确组合的概率可能并不比一个“看上去对”的错误组合高,模型就容易瞎编。

4、采样机制本身允许“走偏”

生成时为了保持多样性和创造性,模型会从概率分布里做随机采样,而不是永远选概率最高的那个词。这就像你写文章时偶尔会冒出一个“异想天开”的词,这个“异想天开”有时就滑向幻觉。

所以从根源上看,幻觉是概率语言模型与生俱来的“影子”,不可能彻底消灭,因为模型的底层目标就不是“求真”,而是“拟合语言的概率分布”。

当然,我们可以通过一些工程手段来吧幻觉概率降低:

检索增强生成(RAG):不让模型仅凭自己的“参数记忆”回答,而是先从一个外部知识库(文档、数据库)检索出相关事实片段,然后让模型基于这些可溯源的材料来组织语言。这样就把“事实来源”外挂了,模型的概率只是负责把事实串成通顺的话。

用工具和代码验证:涉及计算、查询精确信息时,让模型调用计算器、搜索引擎、API,而不是凭概率“编”结果。比如“帮我算一下19234.5 ÷ 17”,模型直接写代码执行,而不是预测数字。

强化学习与人类反馈 & 事实性对齐:在训练阶段,刻意惩罚那些“听起来像真的但实际错误”的答案,奖励模型说“我不知道”。这样可以微调模型的概率分布,让它更倾向于承认不确定性,而不是强行生成一个概率尚可的错答案。

思维链与自我校验:让模型在内部多步推理,并在生成后自我检查是否有矛盾、违反常识,这种多步过程可以修正部分低级的幻觉。

如果我们要求的是 “在任何开放域问题上,零幻觉” ,那答案是:只要还是纯概率自回归模型,就做不到。

二、信息始终存在衰减

我之前在一篇文章中有讨论过一个点,那就是真实世界的所有信息量如果是100的话,那么我们人类目前所有从真实世界中获取的信息是60左右(甚至更少),然后我们提供给大模型进行训练的知识可能只有30-40左右。

也就是我们人类都不能完全完整的认识这个世界,而且万事万物在不断变化,我们人类收集、整理获取的信息始终有限。以这个有限的信息去训练模型,那么这个模型必然也会受到限制。

更不要说,人类的信息中会存在很多垃圾信息,错误信息,非一手信息。比如说我们常说的商业信息,如果不是亲临一线,获取一手资料,只是从网络上扒信息,那么这些信息的价值又有几何呢?

我们策划各种商业项目的时候,整个方案从逻辑上是完全闭环的,为什么项目一旦进入实际商业社会运行的时候,就显得牛头不对马嘴呢。这就是因为我们拿的信息没有真实的反应实际情况,或者拿到的信息不全面。

三、人

即便我们拿到了最全面的信息,我们人也会从过往形成的价值观、主观偏好上来解读拿到的信息。

模型本身也是被训练出了价值观或者其他的偏向性,那么如何保证模型不会对信息进行曲解呢?

这些大模型公司背后团队的价值观和偏向性就一定客观公正吗?

使用大模型的人,他的价值观和主观偏好又该怎么规避呢?

我们也知道,信息在传统企业中是非常重要的,有很多人在传递信息到其他团队和下级的时候,可以隐瞒部分信息,来形成权力垄断。这种情况充斥着大大小小,传统或者现代的行业和公司,那这种情况我们凭什么会认为在有了大模型之后就不会存在呢?

各种之前就存在的灰色部分,难道就不会存在了吗?

我不会这样认为,只要有人存在,人与人之间存在博弈和竞争,那么就必然会有对信息的控制,必然有很多灰色部分存在。这些部分,大模型是无力解决的。

所以,综上所属,我不认为大模型能够解决一切问题。

下一篇文章,我们会聊聊,从我自己的实践和与其他人沟通,在目前阶段,大模型适合解决哪些问题和不能解决哪些问题。

本文由人人都是产品经理作者【markzou】,微信公众号:【markzou的笔记】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图来自Unsplash,基于 CC0 协议。