惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

The Last Watchdog
The Last Watchdog
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
GbyAI
GbyAI
Y
Y Combinator Blog
CTFtime.org: upcoming CTF events
CTFtime.org: upcoming CTF events
The GitHub Blog
The GitHub Blog
博客园_首页
小众软件
小众软件
I
InfoQ
J
Java Code Geeks
月光博客
月光博客
S
Secure Thoughts
Microsoft Security Blog
Microsoft Security Blog
V
Visual Studio Blog
Hacker News - Newest:
Hacker News - Newest: "LLM"
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Stack Overflow Blog
Stack Overflow Blog
cs.CV updates on arXiv.org
cs.CV updates on arXiv.org
N
News and Events Feed by Topic
Exploit-DB.com RSS Feed
Exploit-DB.com RSS Feed
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
The Cloudflare Blog
T
Threat Research - Cisco Blogs
A
About on SuperTechFans
H
Help Net Security
MongoDB | Blog
MongoDB | Blog
博客园 - 聂微东
人人都是产品经理
人人都是产品经理
H
Hackread – Cybersecurity News, Data Breaches, AI and More
Recent Commits to openclaw:main
Recent Commits to openclaw:main
Latest news
Latest news
G
GRAHAM CLULEY
IT之家
IT之家
C
Cisco Blogs
Last Week in AI
Last Week in AI
Engineering at Meta
Engineering at Meta
L
LangChain Blog
The Register - Security
The Register - Security
SecWiki News
SecWiki News
M
MIT News - Artificial intelligence
NISL@THU
NISL@THU
T
Tenable Blog
博客园 - Franky
美团技术团队
I
Intezer
U
Unit 42
雷峰网
雷峰网
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
S
SegmentFault 最新的问题
C
Cyber Attacks, Cyber Crime and Cyber Security

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理, 企事业单位数字化的业务供需本质 – 人人都是产品经理, 医疗智能体·第1讲——医疗信息化重构:从“辅助软件”到“自主智能体”的范式转移 – 人人都是产品经理, 粉丝量就是空气!!! – 人人都是产品经理, 用户说“薯片碎了”,机器回“要买吗?”:意图识别的翻车与破局 – 人人都是产品经理, RAG召回准确率从75到90 我做对了这三件事 – 人人都是产品经理, AI大事件:Anthropic改收费、OpenAI发安全版、手术机器人纳入医保、阿里发布”秒悟” – 人人都是产品经理, Chrome 推出 Skills 新功能,Agent 重塑上网方式 – 人人都是产品经理, GitHub前创始人拿了a16z的1700万美元,做Agent时代的Git – 人人都是产品经理 拷贝或克隆其他 Flutter OH 项目到本地后无法运行 – 人人都是产品经理, 优惠券设计:优惠券创建 – 人人都是产品经理, 不用死磕文档!AI 助手 1 小时搞定飞书 CLI 安装 + 配置 + 知识库 – 人人都是产品经理, 用小龙虾做竞品分析报告:从2天到20分钟,我是怎么做到的 – 人人都是产品经理 用小龙虾做市场分析报告:搞懂这3个公式,市场规模不再靠猜 – 人人都是产品经理, 你早就在做 Harness 工程,只是不知道它叫这个名字 – 人人都是产品经理, Think Long就够?你可能想多了! – 人人都是产品经理, 货代SRM实战:供应商准入怎么做,才能让资源池不是通讯录而是可交付网络? – 人人都是产品经理, 如何做好用户调研?详解基本技巧 – 人人都是产品经理, 木鸟、途家、美团对打,平台春天行动开“卷” – 人人都是产品经理, 入职才发现公司不靠谱?小红书从业者求职避坑指南 – 人人都是产品经理, 美国 AI 三巨头联手封堵,中国 AI 突围之路在何方 – 人人都是产品经理, 小红书,放在需求对面的镜子 – 人人都是产品经理, AI 会带来大规模失业吗? – 人人都是产品经理, 从出单到补货前,我第一次犹豫:该不该放大? – 人人都是产品经理, Flutter 三方库鸿蒙化适配:5 种高效检查方式,快速判断是否需要适配 – 人人都是产品经理, 从做产品进阶拿结果:医美机构产品经理转岗科室运营经理 – 人人都是产品经理, 阿里HappyHorse,一场关于“Token经济”的阳谋 – 人人都是产品经理, To B AI:客户留存落地的观察与思考 – 人人都是产品经理, AI产品的“生命线”——数据采集、标注、清洗的产品化设计 – 人人都是产品经理, 谈谈AI Agent(二):当“孩子”能自己“体验世界”时,你该学什么? – 人人都是产品经理, UI/UX设计师的3层能力进阶,前两层让你活下来,第三层…才是真正的分水岭 – 人人都是产品经理, 2分钟 → 30秒,效率提升75%:B端产品经理如何用「规则枷锁」驯服AI幻觉? – 人人都是产品经理, 还没来得及学OpenClaw,来了个更猛的:Hermes Agent – 人人都是产品经理, AI日报:宇树机器人跑出10m/s刷新世界纪录 – 人人都是产品经理, 一文说透基金互金如何用情绪价值引导用户决策做转化 – 人人都是产品经理, 当浏览器开始替你”看”网页:AI 浏览器正在亲手拆掉它脚下的那张网 – 人人都是产品经理, 0代码,一天时间我Vibe Coding了个网站 – 人人都是产品经理, Hermes 和 OpenClaw 之争,Agent 的能力应该“装上去”还是“长出来”? – 人人都是产品经理 视频生成的“桌子”,字节Seedance 2掀完,阿里快乐马掀 – 人人都是产品经理, 从听不懂到完全信任:我的 Codex 深度产品体验 – 人人都是产品经理, 当虚拟偶像有了北京户口,与真人偶像还有什么区别? – 人人都是产品经理, 会说,远远比会做更重要 —— 对 SBTI 爆火现象的五层观察 – 人人都是产品经理, AI产品经理必看:当“搭环境”比“选模型”更重要,你的认知还在2024年吗? – 人人都是产品经理, 2026年AI产品商业化核心逻辑:从功能demo到规模化营收的3个必破卡点 – 人人都是产品经理, 京东围绕供应链,卷起裤腿下场的那些事儿 – 人人都是产品经理, SBTI一夜刷屏:它赢在了“太会说人话” – 人人都是产品经理, 折扣零售的真相:不是便宜,而是价值感! – 人人都是产品经理, 和甲方吵了一架,最后加钱做了——我学到的ToB产品经理生存法则 – 人人都是产品经理, 和几位小红书操盘手聊了8小时,干货全在这 – 人人都是产品经理, 智谱GLM-5.1登场,开源模型首超Opus4.6!!! – 人人都是产品经理 Anthropic收入凭什么反超OpenAI,终于有人把这事说清楚了 – 人人都是产品经理, 史上最有故事感的技术报告——Claude最强模型Mythos 7个极其精彩的细节 – 人人都是产品经理, 模型不是壁垒,Harness 也不是 – 人人都是产品经理, 抖音本地生活业务思考21 – 人人都是产品经理, Superpowers:145k Star的AI编码框架,到底是什么来头? Superpowers:145k Star的AI编码框架,到底是什么来头? – 人人都是产品经理, OpenAI 的路走错了,Anthropic Harness 解法启示:模型需要实践专科生 – 人人都是产品经理, 画原型图的前一步:设计站点地图 – 人人都是产品经理, 给 DeepSeek 的最后一封催更信 – 人人都是产品经理, 手把手教你用 Claude Code 搭建 AI 营销团队:5 个 Agent、12 项技能,独立完成研究、写作、设计全流程 – 人人都是产品经理, 你以为大模型在学语言?不,它在重新发明语言学 – 人人都是产品经理 所谓Skill,不过是AI时代的工业垃圾 – 人人都是产品经理, 聊一聊内容传播的几个方法 – 人人都是产品经理, 当平台开始吃掉生态:从 OpenClaw 被封杀,读懂 Anthropic 的这盘棋 – 人人都是产品经理, 你装了 10 个 AI 插件,Obsidian 还是一个文件夹 – 人人都是产品经理 关于AI智能体架构演进的系统性思考:从单体试水到多体协同的重构 – 人人都是产品经理, 当“人”变成Skill,我们又该何去何从? – 人人都是产品经理 Mythos 事件:前沿 AI 治理的意外实验 – 人人都是产品经理, 货代CRM:信用与风险管理怎么做,才能把坏账风险拦在放货之前? – 人人都是产品经理, 从HR收集自拍照到员工自助录入——我见证了园区人脸识别从”不可用”到”真好用”的全过程 – 人人都是产品经理 千问闯关AI混沌期:阿里画靶,吴嘉张弓,马云射箭? – 人人都是产品经理,
Demis Hassabis:当 AI 开始解释和操作世界,就不再是工具,而是真实世界参与者
有新Newin · 2025-06-15 · via 人人都是产品经理

在人工智能领域,DeepMind的联合创始人兼CEO Demis Hassabis一直以其前瞻性的研究和创新成果引领着行业的发展。他不仅在游戏、神经科学和AI研究之间架起了桥梁,还通过AlphaGo、AlphaFold等项目展示了AI在解决复杂问题上的巨大潜力。

作为一位跨越游戏、神经科学与 AI 研究的科学家,Google DeepMind 联合创始人&CEO、2024 年诺贝尔化学奖得主 Demis Hassabis 在美国高级研究院(IAS)的分享中,多次强调他对“智能系统的建构过程”本身的关注,以及他所提出的猜想:“自然界中一切可被发现的模式,理论上都应能被经典学习算法所建模。”

Hassabis 告诉 IAS 院长 David Nirenberg, 游戏、科学与数学并非应用终点,而是构建世界模型能力的核心训练场。

无论是 AlphaGo、AlphaFold,还是最新的 Gemini 模型与 Project Astra,DeepMind 的路线始终围绕“模型主导的决策与规划能力”,而非仅止于语言生成;在 AGI 尚不成熟的当下,他将 DeepMind 定位为“科学工具的开发者”,而非产品制造者。

AI 的最重要任务,不是替代人类,而是作为“协作型智能系统”,帮助人类提出新问题、建立更复杂的世界模型、拓展认知边界。而研究院的角色,也许正如他所言,是构建这一进程所需的“制度新范式”的最早试验场。

I/O 到 iO,Jony Ive 将推动一场新的设计运动 —— AI 正在改写计算范式与硬件定义,也是大模型后的新战场

从游戏,到 AI 科学家

对 Demis Hassabis 而言,游戏远不止是一种个人兴趣,而是一扇通往智能本质的窗口。他从象棋启蒙,逐步深入围棋、扑克等复杂博弈,并由此建立起一种长期认知直觉:游戏不仅是策略与技巧的集合体,更是现实世界结构的压缩映射。

在游戏中,决策路径清晰、反馈回路紧密、变量可控,正是构建与验证智能模型的理想场景。Hassabis 并非孤立地提出这一观点。

图灵、香农、冯·诺伊曼等计算理论奠基者,早在 20 世纪中叶便开始以博弈为切入点,尝试理解人类理性与机器决策的边界。

回顾《博弈论与经济行为》《游戏中的人》等经典著作,他强调游戏在现代科学与社会科学建模中的基础地位。游戏的价值不仅在于规则的清晰与目标的可量化,更在于它们能生成大量结构化数据,为 AI 提供极具操作性的训练素材。

DeepMind 在开发 AlphaGo、AlphaZero、MuZero 的过程中,始终沿用从规则设定、策略建模到反馈调优的闭环流程。在他看来,这种建模方式就像语言或符号系统,是 AI 理解世界的一种基础能力。

亚洲文化中的围棋,则是这种博弈思维的极致体现——它蕴含极深的空间直觉、战略规划与哲学思辨,这些特性也逐渐转化为 AI 理解复杂情境的基础结构。

完全信息博弈如象棋、围棋,为模型提供了规则完整、观测充分的训练基础,适合作为算法的起步阶段。而像德州扑克这样的不完全信息博弈,则引入了隐藏变量与博弈策略的多层次推演,使模型能更贴近现实中复杂、不确定的信息环境。

DeepMind 的研究从前者起步,逐渐向后者拓展,并延伸至更具开放性的任务,如语言、多模态理解与现实场景推理。这一演进轨迹在最新系统 Gemini 与 Project Astra 中得到体现,这些模型已具备多模态输入处理能力,在图像识别、语言理解与直觉物理之间建立跨域映射。

在某些看似轻松的游戏场景中,如“你比划我猜”这类含有动作、语言与语境推理的交互任务中,这些系统已经表现出显著的情境感知与响应能力,显示出模型内部对规则、目标与变化关系的综合建模能力。

Hassabis 坦言,DeepMind 并不将博弈本身视为终点。AlphaGo 胜出后的一次重大转向——那场比赛结束后,他几乎立刻着手筹建一个跨学科团队,转向攻克蛋白质结构预测问题。

在他看来, AGI 的理想系统,必须能够在多个任务之间迁移、在不同领域表现稳定,博弈只是这个过程中极好的训练平台,而不是目标本身。真正值得投入的,是那些科学价值高、结构复杂且拥有可验证反馈的问题。

他回忆,少年时期便热衷于思考“意识从何而来”“宇宙为何存在”这类宏大命题。物理学大师如费曼、Steven Weinberg 的著作曾一度吸引他走向理论物理,但物理理论在当时陷入发展停滞的现状,也令他意识到,仅靠个体智识已难以推动终极问题的突破。

因此,他转而追问:能否构建一个人工系统,使其帮助人类从另一个角度理解智能本身?如果构建智能系统就是一项科学实验,那么我们是否可以通过“造出智能”来反过来解释人类的思维过程?

在与 Nirenberg 的对话中,一个关键问题被提出:AlphaFold 的突破,是建立在超过十万条蛋白质结构数据的训练集之上,而这些数据正是数十年科研积累、成千上万位生物学家逐步解析的结果。那么,当 AI 要处理更复杂、数据稀缺的问题时,如何保证类似的训练基础?

Hassabis 坦言,AlphaFold 确实站在结构生物学半个世纪积累的肩膀之上。但他也补充,团队在开发早期版本时,采用了“自举训练”的策略:先利用一个不完善的模型预测出一百万个新蛋白质结构,再从中挑选三十万个最可信的结果加入训练集,从而用合成数据反向扩展训练基础。这种数据生成策略不仅提升了模型的泛化能力,也验证了模型本身的科学合理性。

他解释,选择蛋白质结构作为攻坚对象,正是因为这个问题满足了几个关键条件:有明确的目标函数、有结构化数据支持、有科学界认可的验证方法,而且其本质为一个建模问题——这是 AI 表现出最大潜力的领域。

因此,DeepMind 在其他方向的项目选择中,也始终遵循这一原则:寻找那些问题定义清晰、难度高、可验证的科学任务。而他本人也长期关注各类跨学科环境中的潜在研究对象,尤其是在 IAS 等研究机构驻留期间,习惯性地寻找“下一个 AlphaFold”。

Alpha 系列系统的方法论本质也承袭了这一思想:首先从真实世界中提取结构化问题,在神经网络模型中构建预测与表达框架;再通过大规模搜索与反馈机制优化策略路径;最后在精度反馈中不断调整权重,实现建模、验证与迁移的完整闭环。

这一通用逻辑,不仅适用于游戏与生物学,还正在拓展至数学、物理与经济等复杂系统中,显示出 AI 不再是工具角色,而是成为“科学探索参与者”的可能路径。

渐渐成为世界的参与者

在 DeepMind 的构想中,一个理想的 Agent 应该能够感知环境、模拟未来、理解因果,并对新情境做出合理反应。它不仅是对 LLM 阶段的延展,更是对“理解”能力本身的一次技术实现。

Project Astra 和 Gemini 的协同,正试图在技术架构层面实现这一智能蓝图。Astra 更强调持续感知与任务执行,关注系统如何在现实世界中长期运作、获取信息、调整策略;而 Gemini 则着力于构建通用的多模态理解引擎,在语言、视觉、音频、代码等领域同时训练与融合,构成 AI 的“认知中枢”。

Demis Hassabis 特别强调了一点:Astra 并非“升级版 ChatGPT”,而是一次认知架构的重构尝试。它不是从“语言出发”的生成系统,而是从“世界建模”出发,目标是让 AI 能够解释与推演现实中的复杂现象。

他希望未来的 AI 能像人类一样,用一套稳定但可扩展的认知框架,在不同情境中灵活应对、多轮互动并主动发现问题。

为了测试这些能力的上限,DeepMind 正在设计一系列更具挑战性的世界建模任务。这些任务既包括对自然语言和物理环境的组合理解,也涵盖了复杂因果结构、多步推理链路与跨模态行为规划。

例如:生成一个“厨房日常”场景,要求模型理解角色意图、物体属性、事件先后顺序与多种突发状况的应对策略。只有在此类任务中取得突破,AI 才可能真正具备作为“世界代理人”的能力。

与此同时,Hassabis 也强调技术之外的维度。一旦 AI 拥有解释世界与操作世界的能力,它就不再只是工具,而是参与者。此时的问题将不再局限于“技术做得到什么”,而是“技术应该做什么”,以及“由谁来决定它做什么”。

他反复提及制度建设的重要性。未来的 AI 需要被纳入一个类似“科学共同体”的社会机制中,由不同学科背景的专家共同审议其发展方向与边界。不能只由工程师来决定 AI 的能力上线,也不能让单一公司掌控模型的价值排序机制。

对此,他建议设立一个全球性、去中心化的协调机制,覆盖从模型训练到部署再到治理的全链条流程,并具备伦理判断力与政策协调力。

这也引申出 DeepMind 多年来一贯的价值观:技术突破不应脱离社会语境,科学探索必须与制度伦理并行。在 Project Astra 的开发过程中,他们便引入了伦理顾问、语言学家与政策专家的参与,试图在系统构建初期就嵌入价值讨论。这种做法并非为了规避风险,而是出于深层理解:智能系统一旦真正具备自主性,后设规则的构建本身就是一项前置工程。

Hassabis 将当前的阶段视为“智能系统的结构重塑期”,而非应用产品的爆发窗口。真正的飞跃,将来自我们是否能成功建立起能映射世界结构、具备推理更新能力、能持续运行于现实环境的系统。正如他所说:“我们所构建的,不应只是更快的语言模型,而是更强的思维引擎。”

或许未来十年,衡量一个 AI 系统是否“先进”的标准,将不再是它生成了多长的回答、多快的图片、多准的语义匹配,而是它能否理解一个看似简单却富含结构的场景:一个人站在厨房里,切下一片番茄,然后顺手放进锅里。

这其中涉及的不只是动作,更有时间的连续性、空间的协调性、工具与目标的关联,以及背后的计划逻辑与行为意图。这一能力的实现,标志着 AI 从“表面智能”向“结构智能”的跃迁,也标志着 DeepMind 从算法优越向认知系统建构的路径切换。

这场转变不会一蹴而就,也不会只有一家公司完成。Hassabis 认为,重要的不是谁第一个做到,而是谁能在每一个关键节点上,保持对“什么是智能”的真实追问;在 AGI 真正落地前,必须先建立一个透明、负责任且能够承载公共讨论的平台。否则,无论技术多先进,它也只是另一个无法理解自身的系统。

数学,走向 AGI 核心

在 DeepMind 的最新研究中,一条看似冷门的路径正逐步走向 AGI 的核心——数学。DeepMind 的数学团队近年来频繁出现在各大研究机构,与数理逻辑、代数几何等基础学科的学者共同探讨一些最抽象的问题。

其中最具代表性的成果之一,是一个名为 AlphaProof 的系统,它尝试把数学定理的证明过程转化为一种类似棋局的策略搜索。团队的基本设想是,证明就像下棋,每一步都在向目标命题靠近。系统基于 Lean 这样的形式语言,在严格的逻辑规则中进行推理,寻找可行的解题路径。

与传统符号逻辑不同,AlphaProof 展现出一定的生成能力——不仅能自己生成训练样本,还能自主完成验证。这一过程摆脱了对人工标注的依赖,显示出更强的自适应能力。

对于“如何选择 AI 研究方向”,Hassabis 给出了自己的判断标准:这个问题是否有清晰的目标函数,是否能够自动或大规模生成高质量数据,是否足够复杂到可以测试 AGI 的边界。

他认为,数学正好满足所有这些条件。特别是验证环节,数学问题具备天然的“自动判定”属性,是构建高效闭环系统的理想场景。

在诸多数学议题中,Hassabis 尤其关注 P vs NP 问题。他称这一千禧年难题为 AGI 时代的“灵魂追问”,它不仅关乎计算复杂性的边界,也关系到推理系统能否在有效时间内解决复杂问题。

他坦言,如果能在某个夏天专心钻研,他会将全部精力投入这个问题。在他看来,从 AlphaGo 到 AlphaFold,每一次技术飞跃都是对“可计算性”边界的挑战。

从数学推理走向更广义的世界建模,Hassabis 强调 DeepMind 多年来始终坚持的一条主线:构建“世界模型”。无论是早期的 Atari 游戏、围棋系统,还是后来的分子结构预测,其核心目标都不是单纯给出答案,而是帮助 AI 理解世界的运作方式。

所谓世界模型,指的是 AI 能够模拟空间结构、物理规律、因果关系与动态场景变化的能力。这一概念与 Hassabis 早年的神经科学研究密切相关。他在剑桥时期曾研究大脑中“记忆”与“想象”机制,并发现人类回忆过去和设想未来时,脑区高度重叠。

这意味着,人类之所以能规划未来,是因为大脑本质上具备一种基于过往经验的“内部模拟器”。这也成为他构想 AI 时的重要参考——让系统拥有类似的模拟能力,而不仅仅是输出语言。

这个理念正在 DeepMind 的两个核心项目中逐步实现。Project Astra 是其中之一,它正在尝试打造一种“持续感知+推理+行动”的 agent 原型,而 Gemini 模型家族则承担了多模态理解的基础工作,支持文本、图像、代码、音频乃至视频的统一处理框架,并具备一定程度的因果建模与语义一致性能力。

Gemini 因此被设计为一种具备通用认知能力的系统,它融合了语言生成的灵活性、视觉识别的准确性、物理推理的严密性和代码逻辑的结构性。而 Astra 则更贴近应用场景,目标是构建一个能够长期交互、主动理解环境、完成实际任务的“数字伙伴”。

在 Hassabis 的构想中,AI 不应仅仅是预测工具,而应是具备内在建模能力的系统,能够通过理解世界而不是仅仅复制语言,去完成复杂任务。

DeepMind 的技术演进路线——从博弈、分子、数学再到多模态世界建模——实际上一直在锚定同一个方向:通过建构对世界因果结构的抽象模型,建立具备推理能力的 agent。

当一个模型可以以“切番茄”这种日常而复杂的任务为入口,展现出对空间、力学与行为逻辑的连贯理解时,某种全新的智能形态,已经悄然浮现。这不只是模型能力的展示,更像是对 AGI 可能形态的一次原型验证。

理解世界,具身是否必要?

在 DeepMind 最近的实验中,一个 Demis Hassabis 长期坚持的假设正被挑战:要让 AI 理解世界,是否真的必须赋予它“身体”?

过去,Hassabis 深信智能必须具身,认为理解物理规律和发展直觉认知需要通过身体与环境的交互。

但这次的实验结果显示,仅通过图像数据,AI 就能在没有传感器或触觉的情况下模拟出高度复杂的物理过程。它不仅能重现刀切番茄的过程、水珠飞溅的细节,甚至连光线反射的变化都捕捉得真实而稳定。这种能力展现了系统对时间因果结构的理解,令人意外。

Hassabis 承认,这超出了他对“感知”边界的原有理解,也表明 AGI 的发展可能不再依赖身体经验。

当 Nirenberg 提问为何大学和基础研究机构在 AI 演化中正逐渐边缘化?Hassabis 表示,DeepMind 之所以在企业内部开展基础研究,是出于现实考量。相比学术界,企业在算力、工程资源和资金效率上有着显著优势,而初创企业的快速节奏也推动了技术的发展。

本文由人人都是产品经理作者【江天 Tim】,微信公众号:【有新Newin】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图来自Unsplash,基于 CC0 协议。