惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

罗磊的独立博客
Google DeepMind News
Google DeepMind News
MyScale Blog
MyScale Blog
A
About on SuperTechFans
Martin Fowler
Martin Fowler
M
MIT News - Artificial intelligence
Recent Announcements
Recent Announcements
D
DataBreaches.Net
B
Blog
博客园 - 【当耐特】
爱范儿
爱范儿
有赞技术团队
有赞技术团队
P
Proofpoint News Feed
WordPress大学
WordPress大学
小众软件
小众软件
Apple Machine Learning Research
Apple Machine Learning Research
I
InfoQ
Engineering at Meta
Engineering at Meta
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
Last Week in AI
Last Week in AI
Microsoft Azure Blog
Microsoft Azure Blog
雷峰网
雷峰网
量子位
G
Google Developers Blog

量子位

AI自主监测宠物健康,陪狗都不用自己来了!涂鸦Hey Tuya打造全屋智能“超级入口” 燃油SUV车主熬出头了!华为乾崑智驾加持,全新奥迪Q5L率先实现智能化 华人再破硅谷天花板!AI黑马新任CTO,中科大80后 0博士组合拿下ICLR时间检验奖!两个GPT天才本科生+二本逆袭LeCun弟子,十年论文终封神 DeepSeek V4报告太详尽了!484天换代之路全公开 优必选发布Thinker cosmos:加码开发者生态,推动人形机器人走向规模化 DeepSeek-V4发布,华为云首发适配 Mobileye 2026财年一季度营收增长27%,自动驾驶商业化进程持续推进 100%主流车企的共同选择:一个AI“通用底座”正在汽车行业成型 真有人做AI小猫啊?!生产力和情绪价值都拉满了 Coordination Engineering关键一环,JiuwenClaw再发布Team Skills技能新范式 DeepSeek V4终于发布!打破最强闭源垄断,明确携手华为芯片 荣耀WIN游戏本等多款新品正式发布,荣耀PC家族全面爆发 刚刚,GPT-5.5发布!内测英伟达工程师:失去它像被截肢 河南师傅,左手扳手,右手飞书,竟然能搞数据分析! 国内首家百亿估值纯推理GPU独角兽诞生!专访曦望联席CEO王湛:谁的推理成本更低谁就是赢家 印奇站上AI+车浪潮之巅:7个月,千里科技和华为「五五开」 飞书项目开放平台焕新升级,全面迈向“AI Friendly” 半壁华人!GPT Image 2团队曝光:无锡才俊带队,13人4个月封神 Nature封面:机器人乒乓球干翻人类职业选手 特斯拉开源硬件,中国公司回应来了:直接把机器人大脑开源了 挖漏洞何必Mythos,国产智能体早跑通了 “不造车的特斯拉”亮出“舱驾一体”全家桶,汽车长出“主动理解力”,奇瑞比亚迪等10+巨头力挺 科大讯飞发布燎原N30m笔记本,重塑全栈国产AIPC新标杆 神秘模型「大象」:仅100B拿下SOTA,Token效率超高! 香港科创标杆奖项!商汤首席科学家林达华荣获中银香港科创奖 国产多模态Agent拿下医学分割SOTA!不用改模型、不加token 这些人读个博一年能挣几十万?2026苹果学者名单公布了 大厂AI抢人大战,从实习生开始 全球首个世界统一模型发布,机器人家庭成员来了!
机器人原生世界动作模型问世!首创时空一体架构,复旦系团队出品
思邈 · 2026-05-31 · via 量子位

< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400">

机器人原生世界动作模型问世!首创时空一体架构,复旦系团队出品

2026-05-31 18:13:21 来源:量子位

半年斩获5轮融资

允中 发自 凹非寺

量子位 | 公众号 QbitAI

通用人工智能的战火,已经彻底从虚拟的数字空间,一路烧到了真实的物理世界。

毫无疑问,具身智能、机器人大脑,已经成为当下整个AGI赛道最卷、也最核心的决胜高地。

当前行业主流的VLA视觉语言动作模型、通用世界模型、视频推演方案,普遍存在空间感知精度不足、物理逻辑约束缺失、长时序规划能力薄弱、真机落地鲁棒性差等一系列痛点,无法支撑机器人实现真正的自主感知、自主推理、自主决策与稳定交互。

在物理AI产业快速迭代的关键节点,深耕世界动作模型底层技术五年的复旦系科创企业眸深智能,正式推出STI-WM时空一体世界动作模型(Spatiotemporally Integrated World Model)

作为专为机器人原生打造的通用具身大脑,该模型以时空一体化建模、物理一致性约束、端到端原生融合为核心,彻底打破传统模型的技术桎梏,开辟了物理世界AGI落地的最优技术路径。

复旦+英特尔+英伟达,硬核学术成果稳居全球第一梯队

眸深智能的技术突破,源于长期深耕的学术积淀与全栈工程能力。

公司核心团队源自复旦大学深度学习实验室,构建了学术科研、工程落地、产业商业化三位一体的顶级团队架构:

由复旦大学未来信息创新学院教授、深度学习实验室主任陈涛坐镇科研底层,原英特尔中国首席科学家张益民博士和来自英伟达的技术负责人掌舵工程化落地,95后复旦连续创业者穆泽林主导商业化布局,形成实力强劲的“复旦铁三角”核心阵容。

团队超九成核心研发人员来自复旦大学,汇聚百余名校硕博人才,自2021年行业风口未至之时,便前瞻性布局世界模型、三维感知、时序动作生成三大底层核心技术,持续深耕技术攻坚。

多年来,团队斩获多项全球顶尖赛事冠军与顶级学术荣誉

推出全球首个人形动作生成大模型MotionGPT、三维世界模型HL3DWM;

拿下ICCV2023全球三维目标识别冠军、CVPR2024三维密集语义推理冠军,斩获IJCAI2025杰出论文奖,是近五年国内唯一斩获该奖项的具身智能团队,团队技术负责人斩获2025年中国具身智能新秀EAI榜单20强。

其原创技术成果被英伟达DAIR等国际顶尖实验室引用,学术创新与工程落地能力稳居全球第一梯队。

重构行业技术范式:5年沉淀,开创并引领世界动作模型路线

当前行业多数方案仍采用通用世界模型+VLA拼接的改良模式,模态割裂、信息损耗严重,缺乏真实物理世界约束,只能实现“视觉合理”,无法适配机器人真机落地的真实需求。

眸深智能从AGI本质出发,率先确立世界动作模型原生融合路线

机器人与物理世界的一切交互,最终都落地为动作,唯有精准理解时空演化规律、遵守物理逻辑、实现端到端原生映射,才能真正解决机器人泛化性差、落地难的行业顽疾。

早在2022年,团队便创新性提出全球首个影空间语言-动作端到端映射MLD模型,成果发表于CVPR 2023,该核心思路在2025年5月被英伟达DAIR实验室核心工作引用验证。

历经五年迭代,团队已完成7代动作模型技术更新,在多模态端到端融合、高精度动作生成、时序逻辑推演领域积累深厚,动作精度、推理速度、任务泛化性持续领跑行业。

机器人原生架构四维统一,破解真机落地核心痛点

不同于行业依托大语言模型二次改造的适配性方案,STI-WM时空一体世界动作模型是完全面向机器人长时序规划、在线闭环控制、真实物理交互打造的原生具身智能框架,实现空间结构、时间演化、物理一致性、执行鲁棒性四维一体化统一。

模型可兼容RGB图像、深度点云、机器人本体多模态感知输入,将复杂环境信息统一编码为紧凑高效的时空潜在世界状态,上层支撑百秒级长时程任务推演与全局轨迹规划,下层输出精准可控的精细化动作片段。

同时依托实时环境观测动态纠偏、在线重规划,构建出“理解世界—推演未来—规划动作—执行纠错”的完整物理智能闭环。

相较于Dreamer系列偏重环境预测、忽视真机控制的通用世界模型,LWM、PWM等时空割裂的抽象动作模型,以及仅追求视觉逼真、无视物理可行性的视频生成模型,STI‑WM跳出纯视觉推演误区,以三维几何约束、动力学校验、真机闭环执行为核心,彻底解决传统模型信息失真、泛化薄弱、落地困难的核心痛点,让机器人真正做到看懂三维空间、遵守物理规则、自主规划任务、稳定闭环执行

△眸深STI-WM1.0时空一体世界动作模型架构

六大核心技术壁垒,支撑机器人规模化落地

依托五年全链路自研积淀,STI‑WM构建起行业难以复刻的技术优势:

  1. 时空一体化原生建模:空间结构与时间动态实时耦合,消除多模块拼接的信息损耗,大幅提升推理效率与决策精准度;
  2. 原生三维感知能力:基于点云直接还原真实物理空间,彻底规避2D视觉深度缺失、空间误判的固有缺陷;
  3. 内置物理一致性引擎:融合碰撞检测、动力学约束,从底层杜绝不合理动作与环境崩坏,保障真机执行安全稳定;
  4. 长时程高阶规划:突破传统短片段动作局限,支持百秒级连续复杂任务自主推演,适配真实场景复杂作业需求;
  5. 端侧轻量化部署:自研模型压缩、量化蒸馏技术,实现百亿级大模型低成本落地机器人端侧芯片,大幅降低产业化算力门槛;
  6. 小样本强泛化能力:依托虚拟世界大规模预训练+少量真机微调,高效适配陌生场景与长尾任务,大幅降低数据依赖。

△眸深“一脑多形”跨本体通用大脑

资本与商业双爆发,产业化进程突飞猛进

凭借底层架构原创创新、全栈自研技术壁垒、可落地的商业化能力,眸深智能迎来高速发展期,半年内完成5轮融资,3亿元Pre-A轮融资获5倍超额认购,获得国家级投资平台、头部产业资本、券商机构的高度认可。

商业化落地同步驶入快车道,公司已与宇树科技、禾川科技、颐家养老等行业头部企业达成深度合作,技术落地覆盖工业制造、居家康养、商业服务等多元真实场景。

目前,眸深智能已与近十家上市公司达成战略合作,其中包含五家以上千亿级产业龙头,未来三年预计可锁定10亿元订单支撑,技术产业化速度远超行业平均水平。

△眸深智能与居家养老头部企业颐家战略合作

当下,AGI竞争正式进入物理智能新时代,以世界动作模型为核心的原生具身大脑,已然成为通用机器人的核心底座。

未来,眸深智能将持续迭代STI‑WM模型体系,全面赋能人形机器人、四足机器人、工业机械臂、服务机器人等全品类硬件,加速通用具身智能的规模化落地,推动中国原生物理AI技术领跑全球,开启物理世界AGI全新纪元。

版权所有,未经授权不得以任何形式转载及使用,违者必究。