惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

The GitHub Blog
The GitHub Blog
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
Microsoft Security Blog
Microsoft Security Blog
J
Java Code Geeks
S
SegmentFault 最新的问题
Apple Machine Learning Research
Apple Machine Learning Research
N
Netflix TechBlog - Medium
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
博客园_首页
宝玉的分享
宝玉的分享
Google DeepMind News
Google DeepMind News
B
Blog RSS Feed
Hugging Face - Blog
Hugging Face - Blog
量子位
Blog — PlanetScale
Blog — PlanetScale
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
阮一峰的网络日志
阮一峰的网络日志
D
Docker
罗磊的独立博客
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
云风的 BLOG
云风的 BLOG
IT之家
IT之家
MyScale Blog
MyScale Blog
Microsoft Azure Blog
Microsoft Azure Blog

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
“大语言模型是死路一条“
微果酱 · 2025-10-11 · via 人人都是产品经理

人工智能领域,大语言模型(LLMs)一直是研究和应用的热点。然而,2024年图灵奖得主、强化学习之父理查德·萨顿(Richard Sutton)却提出了一个惊人的观点:“大语言模型是死路一条”。这一观点在技术界引发了广泛的讨论和反思。

“大语言模型是死路一条”

这是2024年图灵奖得主,“强化学习之父”理查德·萨顿(Richard Sutton)不久前表达的观点,源自知名技术博客Dwarkesh Podcast对萨顿的采访视频。

《强化学习之父Richard Sutton最新采访:LLM是死胡同》

01

目前AI界的主流共识是:LLMs是通往AGI的主要路径。当这股思想洪流滚滚向前时,一个老人在岸边喊了一嗓子:“LLMs are a dead end(大语言模型是死路一条)”。

别人喊这一嗓子,可视为哗众取宠,但出自萨顿之口,则当正冠肃听。萨顿何许人也?如果把AI比作江湖的话,那么能开宗立派的宗师级人物,不过寥寥数人,萨顿为其一,开辟“强化学习“门派,众多门徒活跃在学界和业界,例如DeepMind的几位创始核心成员。

采访内容很丰富:LLM是死胡同,处处闪耀人文思考和哲学思辨光芒。个人粗浅理解如下:

  1. LLMS基于人类知识及语言,而人类知识语言,仅是世界表面的“一层薄薄的装饰”。
  2. “大语言模型的梦想,在我看来,是你可以教智能体一切。它会知道一切,在生活中不需要学习任何东西。”但现实是:”世界太大了,你无法(提前知道一切)。”
  3. “我们必须理解我们是如何作为动物的。如果我们理解了松鼠,我认为我们就几乎完全理解了人类智能。语言部分只是表面的一层薄薄的装饰。”

基于此,萨顿认为LLMs无法真正理解世界。

02

这一点,中国道家思想早有阐述。关于人类知识和语言的局限性,老子《道德经》开篇即说:“道可道,非常道;名可名,非常名”;庄子在《养生主》中写道:“吾生也有涯,而知也无涯,以有涯逐无涯,殆已!”

LLMs以人类知识和语言为基础,采用“预训练-微调-对齐”的求知方式,无疑踏上的是“以有涯逐无涯“的不归路。

这种局限性必然导致这样一个结果——大模型给你的,是它计算给你,而不是世界的本质;你需要的是大模型听你的,为你所用,而不是世界的真相。

“强化学习是关于理解你的世界,而大语言模型是关于模仿人类,做人们说你应该做的事。它们不是在搞清楚该做什么。”

这样的结果,必然导致这样一个结局:

萨顿指出了当前深度学习系统的一个根本性问题——泛化能力差:”我们没有任何方法擅长这一点。”他解释说,虽然关键的性能指标是能够从一个状态很好地泛化到另一个状态,但”我们没有任何自动化技术来促进迁移,它们都没有被用于现代深度学习。”

虽然LLMs能解决越来越复杂的数学问题,从简单的加法到需要使用不同数学技术和定理的奥数问题,但萨顿认为这不是真正的泛化:”如果只有一个答案,而你找到了它,那不叫泛化。那只是唯一的解决方法,所以他们找到了唯一的解决方法。”真正的泛化是”当可能是这种方式,也可能是那种方式,而他们选择了好的方式。”

一个没有泛化能力的AI,自然不可能从中诞生超级智能,也就是说,在通往AGI的终点上,LLMs是死路一条。

03

萨顿这一观点对当下AI应用有何影响呢?从宏观角度看,有影响,也没有影响。

  1. 没有影响,是因为LLMs是对人类现有所有知识和语言的重新淬炼,是对已知世界的一次生产力大提升,它是当下以及可预见未来的科技发展核心,将在千行百业发挥巨大作用。对此,萨顿并不讳言大语言模型近年来取得的巨大成功。
  2. 有影响,是当LLMs耗尽人类现有所有知识和语言后,就可能进入停滞状态,而无法引领人类走向不可预见的、更深邃的未来。今年初,马斯克就在CCS的采访中说,现实世界用于AI模型训练的资料,已经消耗得差不多了。

从微观的、具体应用的角度看,则有着积极的影响——LLMs目前已经被神化,似乎无所不能。然而,在实际应用中,却遇到了许多问题,很多花了大钱做了大模型落地的企业,反馈并没有取得预期效果。传媒影视业同样如此。在上一篇文章《AI视频生成不需要创造力,需要的是组织力》中,我提及目前AI视频创作的困扰,根本原因就在于LLMs的泛化能力太差,而萨顿认为LLMs泛化能力差是无解的,这将修正我对AI视频创作的观点和做法,将LLMs从神坛拉下来,而转向如何结合过往经验,更细致、更有效、更理性地理解和应用LLMs。

相信这一心得,不仅适用于传媒业,也适用于千行百业。

本文由人人都是产品经理作者【微果酱】,微信公众号:【AI微果酱】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图来自Unsplash,基于 CC0 协议。