惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

大猫的无限游戏
大猫的无限游戏
U
Unit 42
T
Tailwind CSS Blog
罗磊的独立博客
WordPress大学
WordPress大学
小众软件
小众软件
Recent Announcements
Recent Announcements
博客园 - 聂微东
Jina AI
Jina AI
云风的 BLOG
云风的 BLOG
博客园 - 【当耐特】
爱范儿
爱范儿
Microsoft Azure Blog
Microsoft Azure Blog
GbyAI
GbyAI
V
V2EX
博客园 - 三生石上(FineUI控件)
I
InfoQ
雷峰网
雷峰网
G
Google Developers Blog
阮一峰的网络日志
阮一峰的网络日志
B
Blog
腾讯CDC
A
About on SuperTechFans
博客园 - 叶小钗

少数派

派早报:Google 发布 Fitbit Air 等 - 少数派 「新人报到」確認需求,再開始 - 少数派 从 SOLO 独立开发者社区,我看到了越来越多开发者开始做自己的产品 - 少数派 我怎么管理那些"不常做,但总会忘"的生活事项 - 少数派 人形机器人量产元年,数据才是具身智能的“生死线” - 少数派 BuhoLaunchpad 高度还原 Mac 启动台:开发历程与思考 - 少数派 五年陪伴依然不舍,DIY 换壳后让罗技 MX Master 3 继续服役 - 少数派 新玩意 240|少数派的编辑们最近买了啥? - 少数派 一日一技|为什么你应该关闭 iOS 的键盘声音 - 少数派 我做了个插件和 Skills,一键提取任何网站的设计规范 Design.md - 少数派 住在三四线城市的你,该开始录播客了 - 少数派 甘南秘境,大白高国 - 少数派 AI的审美:谁让把我变成川内倫子 - 少数派 返工怎能不烦恼,打工人片单总有一部是你的「嘴替」 - 少数派 为了让「上厕所」更健康,我做了一个小工具 - 少数派 AI + Skill,能够让生成的文章去除 AI 味吗? - 少数派 新玩意|韶音OpenDots ONE 耳夹式耳机 - 少数派 《美满》| 在每一个春天的晚上相爱(362) - 少数派 新玩意|优篮子 PS01 MagSnap 磁吸支架 - 少数派 自我整合手记 | 我开始早睡了:用稳定规则,为自由托底 - 少数派 用龙虾(OpenClaw)两个多月,我最深的12个体会 - 少数派 听歌时间到,12 张你可能错过的 2025 华语乐坛好专辑 - 少数派 承诺能追吗 - 少数派 macOS 26启动台没了? 我做了个不一样的App启动器 - Keboard - 少数派 《四海为家的人》| INTJ对话INTJ(361) - 少数派 你发过的那些黑历史,是时候一次清干净了 - 少数派 新玩意:安安静静玩,越玩越专注:计客密码机 - 少数派 iPad 用户首次体验 Android 平板:vivo Pad6 Pro - 少数派 数据逻辑强 - 少数派 极北行+ | 一路向北,探访日本至北之地 | 001 - 少数派
ChatGPT没答对:人下午活着,中午还活着吗? - 少数派
2025-08-18 · via 少数派

两个月前,我问了 ChatGPT 一个问题:

如果玛贝尔上午九点活着,下午五点也活着,那么中午她还活着吗?

对人类来说,答案显而易见:活着。但 ChatGPT 却说:不能确定。

这是语言学家史蒂文·平克在 2023 年提出的问题1,用来说明大模型并不真正理解世界。即便掌握了活着的用法,它也未必理解生命在时间上的连续性。

这看似是「模型是否理解世界」的陈词滥调。但在探讨大模型之前,我们得先问:时间到底是什么?如果连我们自己都未真正理解,又如何判断机器是否理解?

时间真实存在吗?

多数人会说时间客观存在,牛顿甚至认为「无须参照任何其他事物,绝对、真正的数学时间按照自身规律自然而然地均匀流动着2。」

我们可以想象没有空间的世界,人漂在黑暗中,什么也看不见,却依然能思考。但很难想象没有时间,因为思考过程会完全卡住。

然而,时间并非外部世界的简单反映,而是心智的产物。看看这些矛盾的例子:时间既非有限也非无限,既有开端又似乎永恒。我们说时间流逝,仿佛时间是河水;说未来在前方,仿佛时间又有方向。

但这些矛盾在现实世界中并不存在,正如康德所说:时间是我们感知世界的方式,而非世界的内在属性。

我们怎么理解时间?

我们对时间的体验也充满特点。首先,我们根本不是在感知时间本身,而是事件。我们无法直接观察时间,只能通过钟摆摆动、心跳节律来计算时间。语言学家称之为「转喻」:用具体事件代指抽象时间。

我们理解时间,完全是目的驱动。「画一个圈」有明确终点,计时会启停;但「四处奔跑」没有终点,大脑就困惑了。这就是为什么「在一分钟内过马路」自然,「在一分钟内慢跑」就奇怪。 有明确终点的行为才容易被计时。

我们甚至用空间来理解时间,我们说时间飞逝时,时间在移动;说走向未来时,我们在移动。南美艾马拉人甚至认为未来在身后(看不见),过去在前方(已经历过),这和我们的直觉相反。

换句话说,要理解时间,必须有身体经验和空间经验作支撑。因此,当我们不假思索地知道「玛贝尔中午还活着」时,依赖的是这一整套认知机制。

大模型可以理解时间吗?

时间推理,一直是大模型的痛点之一3。玛贝尔问题就是一个典型例子。它看似常识,但不平常,它不是可以下载的海量数据库,而是需要少量核心真理和一套推导规则。

康德曾说,空间、时间、因果是先天框架,用来组织感官经验4。大模型可能学习了活着时间的语料关联,却缺乏人类那种内在的概念模型。它执行的是模式匹配,而非解释性推理,即通过规则或直觉理论来理解事物。

玛贝尔问题涉及对存在在时间维度上连续性的理解,如果一个人在时间点 A 和 B 都活着,那么 AB 之间她也必须活着。这对我们不言自明,但暴露了大模型在时间概念上的局限。

不过,ChatGPT-5 现在能答对这个问题了,甚至还能预判我的预判。但正是这种预判让我更加怀疑它。

我是 ChatGPT 全局记忆的早期用户,它太了解我的偏好了。从 4o 的答错到 5 的答对,这是理解的进步,还是算法优化的结果?

大模型如何看待我们的世界?

我又去问了 Claude,它的答案要比 ChatGPT 确定,但也留了一些空间。

大模型的训练数据既包含说明书、新闻这样的真实世界记录,也包含科幻小说、奇幻故事。它能分辨两者吗?当我没说明玛贝尔是人,它默认她是人,因为它「知道」我是人。

也许在它的概率空间里,死而复生并非不可能;而现实世界,只是众多可能世界之一。

结语

玛贝尔问题让我印象深刻,不仅因其简单,更因它触及了「存在与不存在」的本质。任何人类都不会对这个问题产生怀疑,而如果一个 AI 会怀疑,它就不是我们的同类。

这让我想起电影《彗星来的那一夜》。彗星降临后,会产生平行世界,朋友们开始怀疑眼前的人是否还是原来的那个人。为了辨认身份,他们制作了标识盒,里面放着照片、编号和随机信物。

当真正遇到平行世界的「朋友」时,一切都混乱了。外表完全相同的人,拿出信物比对,才发现根本不是原来那个人。

镜头一转,无数组平行世界的人在相互辨认、哭闹、绑架,甚至试图杀死对方。那种错觉和震撼,正如大模型看似理解问题,却在最简单的常识上答非所问,让人不寒而栗。

因为它们越来越像我们,但内在机制可能完全不同。