惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

博客园 - 三生石上(FineUI控件)
S
SegmentFault 最新的问题
Jina AI
Jina AI
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
IT之家
IT之家
美团技术团队
V
Visual Studio Blog
人人都是产品经理
人人都是产品经理
博客园 - 叶小钗
有赞技术团队
有赞技术团队
GbyAI
GbyAI
宝玉的分享
宝玉的分享
腾讯CDC
M
MIT News - Artificial intelligence
博客园 - 【当耐特】
Google DeepMind News
Google DeepMind News
月光博客
月光博客
MyScale Blog
MyScale Blog
Last Week in AI
Last Week in AI
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
博客园 - 司徒正美
Recent Announcements
Recent Announcements
MongoDB | Blog
MongoDB | Blog

Prompt 语宙

kimi-thinking-preview – 月之暗面推出的多模态思考模型 pdf-craft – 开源 PDF 转 Markdown 工具 UltraMem – 字节豆包大模型团队推出的全新超稀疏模型架构 EasyControl – Tiamat AI 联合上海科大等开源的图像生成控制框架 GaussianCity – 南洋理工大学 S-Lab 团队推出的 3D 城市生成框架 X-Prompt – 用于多模态视频目标分割的通用框架 豆包大模型1.5 – 字节跳动推出的最新版大模型 GaussianAnything – 南洋理工 S-Lab 和上海 AI Lab 等推出的 3D 生成框架 Cube 3D – Roblox 推出的 AI 3D 生成模型 OpenMath-Nemotron – 英伟达开源的数学推理系列模型 MAI Transcribe-1.5 – 微软 MAI 推出的语音转文本模型 Seed1.5-Embedding – 字节跳动 Seed 团队推出的向量模型 2026世界杯人机大战引爆!联想携手DeepSeek等顶尖AI大模型,对战亿万球迷预测冠军 高考公平守护战!豆包、文心等主流大模型集体禁用拍题功能 ShotAdapter – Adobe联合UIUC推出的多镜头视频生成框架 Devstral – Mistral AI联合All Hands AI开源的编程专用AI模型 MMaDA – 字节联合普林斯顿大学等推出的多模态扩散模型 Software Copyright Materials Skill – 开源软著资料生成Skill Dulus – 开源的 CLI AI Agent,可驱动多模型工具调用 Reasonix – 专为 DeepSeek 推出的开源终端编程 Agent Mega-ASR – NTU、NUS、上海AI Lab开源的语音识别模型 CodeGraph – 开源代码知识图谱工具,加速代码理解和分析 MiniCPM5-1B – 面壁智能联合清华开源的端侧文本基座模型 Horizon – 开源 AI 信息聚合系统,构建专属新闻雷达 BitCPM-CANN – 面壁智能联合清华开源的端侧大模型 Xiaomi Auto World Model – 小米推出的辅助驾驶世界模型 opera-browser-cli – Opera Neon 开源的命令行工具 omp – 开源的 AI 终端编程智能体,能与 IDE 深度联动 Claude Opus 4.8 – Anthropic 推出的旗舰级大语言模型 Hy-Memory – 腾讯混元推出的 Agent 记忆插件
千寻智能Spirit-v1.5具身智能基础模型发布:多任务泛化能力领...
站外新闻 · 2026-06-15 · via Prompt 语宙

💡 站外导读:随着人工智能从数字世界向物理世界深入渗透,具身智能(Embodied AI)正成为下一个前沿爆发点。然而,当前大多数机器人模型仍受限于特定任务和“干净”数据,泛化能力弱、适应真实复杂环境成本高昂。如何让机器人像人一样,在多样、开放的环境中快速学习并执行多种任务,是产业界亟需突破的核心痛点。千寻智能推出的Spirit-v1.5具身智能基础模型,正试图从根本上解决这一挑战,其技术路径可能重塑机器人的学习与部署范式。

Spirit-v1.5 是千寻智能推出的具身智能基础模型。模型采用多样化、开放式的数据采集方式,摒弃传统“干净数据”的限制,让模型在预训练阶段接触更丰富的动作和场景,具备更强的泛化能力和适应性。在 RoboChallenge 真机评测中,Spirit-v1.5 凭借出色的表现超越此前的领先模型,成为当前最优的具身智能模型,为具身智能的发展提供新的技术路径和开源基准。

  • Spirit-v1.5是什么
  • Spirit-v1.5的主要功能
  • Spirit-v1.5的技术原理
  • Spirit-v1.5的项目地址
  • Spirit-v1.5的应用场景
      • 📝 站长洞察 (Editor’s Insight)

Spirit-v1.5

Spirit-v1.5的主要功能

  • 多样化任务执行:Spirit-v1.5能完成多种日常任务,如插花、水果入篮、挂牙刷杯、贴胶带、清扫垃圾等。

  • 泛化能力:通过多样化的预训练数据,具备在未见过的场景中快速适应和执行任务的能力。

  • 鲁棒性:在复杂环境中表现出色,能应对物体遮挡、光照变化、机械臂协同等挑战。

  • 支持多机器人平台:模型兼容多种机器人硬件,如单臂机器人(Franka、UR5e)和双臂机器人(ALOHA)。

  • 高效微调:在新任务上能快速微调,减少训练时间和资源消耗。

Spirit-v1.5的技术原理

  • 多样化数据采集:模型摒弃传统“干净数据”,采用开放式、弱控制的数据采集方式。采集员围绕任务目标自由行动,生成包含多种原子技能和真实时序关系的数据。

  • 预训练与微调:模型通过大规模多样化数据进行预训练,学习通用策略而非单一任务的最优解。在新任务上微调时,模型能够快速适应并表现出色。

  • Vision-Language-Action (VLA) 模型架构:结合视觉、语言和动作模块,使机器人能理解自然语言指令、感知环境和执行相应动作。

  • 强化学习与自监督学习:模型用强化学习优化任务成功率,同时通过自监督学习提升模型对环境变化的适应能力。

Spirit-v1.5的项目地址

  • 项目官网:https://www.spirit-ai.com/en/blog/spirit-v1-5
  • GitHub仓库:https://github.com/Spirit-AI-Team/spirit-v1.5
  • HuggingFace模型库:https://huggingface.co/Spirit-AI-robotics/Spirit-v1.5

Spirit-v1.5的应用场景

  • 家庭服务:Spirit-v1.5 可协助完成家务劳动,如清洁桌面、整理物品、辅助烹饪等,显著提升家庭生活的便利性和效率。

  • 工业自动化:模型适用生产线操作、质量检测及物流仓储,通过高效执行任务,提高工业生产的效率和精准度。

  • 医疗辅助:在康复训练、医疗物资管理和手术辅助等方面,Spirit-v1.5 能优化医疗流程,为医护人员提供有力支持。

  • 教育与研究:作为科研和教学工具,Spirit-v1.5 助力学术研究和教育普及,推动机器人技术与人工智能的教育发展。

  • 零售与服务:在店铺管理、客户服务和库存管理中,Spirit-v1.5 能提升零售运营效率,改善顾客体验。

  • 农业与园艺:Spirit-v1.5 可用于农作物管理和园艺护理,助力农业生产与园艺维护,提高作业效率。

📝 站长洞察 (Editor’s Insight)

Spirit-v1.5的发布,标志着具身智能正从‘专用技能’向‘通用基础模型’阶段的关键跨越。其摒弃‘干净数据’依赖,采用开放式数据采集的思路,是构建机器人‘世界模型’的重要范式转移,与当前大语言模型追求数据多样性的趋势一脉相承。更值得关注的是其VLA(Vision-Language-Action)架构的落地,这打通了感知、决策与执行的全链路,是构建通用机器人智能的核心骨架。结合其在多硬件平台上的泛化表现,我们看到的不仅是单一模型的进步,更是一个潜在的、标准化机器人开发生态的雏形。未来,谁能率先在真实世界的长尾、非结构化场景中实现低成本适配,谁就将主导下一代机器人产业。Spirit-v1.5的开源,无疑为这场竞赛提供了新的基准和加速度。