惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Martin Fowler
Martin Fowler
大猫的无限游戏
大猫的无限游戏
J
Java Code Geeks
罗磊的独立博客
雷峰网
雷峰网
G
Google Developers Blog
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
爱范儿
爱范儿
B
Blog RSS Feed
腾讯CDC
Apple Machine Learning Research
Apple Machine Learning Research
D
Docker
Recent Announcements
Recent Announcements
T
Tailwind CSS Blog
博客园 - 聂微东
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
Vercel News
Vercel News
小众软件
小众软件
人人都是产品经理
人人都是产品经理
云风的 BLOG
云风的 BLOG
IT之家
IT之家
Blog — PlanetScale
Blog — PlanetScale
I
InfoQ
S
SegmentFault 最新的问题

Prompt 语宙

kimi-thinking-preview – 月之暗面推出的多模态思考模型 pdf-craft – 开源 PDF 转 Markdown 工具 UltraMem – 字节豆包大模型团队推出的全新超稀疏模型架构 EasyControl – Tiamat AI 联合上海科大等开源的图像生成控制框架 GaussianCity – 南洋理工大学 S-Lab 团队推出的 3D 城市生成框架 X-Prompt – 用于多模态视频目标分割的通用框架 豆包大模型1.5 – 字节跳动推出的最新版大模型 GaussianAnything – 南洋理工 S-Lab 和上海 AI Lab 等推出的 3D 生成框架 Cube 3D – Roblox 推出的 AI 3D 生成模型 OpenMath-Nemotron – 英伟达开源的数学推理系列模型 MAI Transcribe-1.5 – 微软 MAI 推出的语音转文本模型 Seed1.5-Embedding – 字节跳动 Seed 团队推出的向量模型 2026世界杯人机大战引爆!联想携手DeepSeek等顶尖AI大模型,对战亿万球迷预测冠军 高考公平守护战!豆包、文心等主流大模型集体禁用拍题功能 ShotAdapter – Adobe联合UIUC推出的多镜头视频生成框架 Devstral – Mistral AI联合All Hands AI开源的编程专用AI模型 MMaDA – 字节联合普林斯顿大学等推出的多模态扩散模型 Software Copyright Materials Skill – 开源软著资料生成Skill Dulus – 开源的 CLI AI Agent,可驱动多模型工具调用 Reasonix – 专为 DeepSeek 推出的开源终端编程 Agent Mega-ASR – NTU、NUS、上海AI Lab开源的语音识别模型 CodeGraph – 开源代码知识图谱工具,加速代码理解和分析 MiniCPM5-1B – 面壁智能联合清华开源的端侧文本基座模型 Horizon – 开源 AI 信息聚合系统,构建专属新闻雷达 BitCPM-CANN – 面壁智能联合清华开源的端侧大模型 Xiaomi Auto World Model – 小米推出的辅助驾驶世界模型 opera-browser-cli – Opera Neon 开源的命令行工具 omp – 开源的 AI 终端编程智能体,能与 IDE 深度联动 Claude Opus 4.8 – Anthropic 推出的旗舰级大语言模型 Hy-Memory – 腾讯混元推出的 Agent 记忆插件
腾讯开源HY-Motion 1.0:一句话生成3D动作,影视游戏数字人必...
站外新闻 · 2026-06-13 · via Prompt 语宙

💡 站外导读:在AIGC浪潮席卷内容创作的今天,3D动画制作的高成本、长周期仍是行业痛点。腾讯混元团队开源的HY-Motion 1.0,正试图用一句简单的自然语言描述,彻底颠覆这一流程。作为一款十亿参数级的文本到3D动作生成大模型,它基于先进的Diffusion Transformer架构与强化学习优化,目标是让高质量3D骨骼动画的创建像打字一样简单,为影视、游戏、虚拟人等产业注入全新生产力。

HY-Motion 1.0(混元Motion 1.0)是腾讯混元团队开源的十亿参数级文本到 3D 动作生成大模型。基于 Diffusion Transformer(DiT)架构与流匹配机制,仅需一句自然语言描述,能生成高保真、流畅多样的 3D 角色骨骼动画。模型采用全阶段训练策略,包括在超 3000 小时多样化动作数据上预训练、在 400 小时精选高质量数据上微调,以及通过强化学习结合人类反馈和奖励模型进行优化。覆盖 6 大类超 200 种动作,输出为 SMPL-H 骨骼格式,支持原子动作、组合序列及并发动作生成。在性能评估中,指令遵循能力达 78.6%,动作质量平均 3.43 分(5 分制),全面超越 MoMask、DART 等开源基线。

  • HY-Motion 1.0是什么
  • HY-Motion 1.0的主要功能
  • HY-Motion 1.0的技术原理
  • HY-Motion 1.0的项目地址
  • HY-Motion 1.0的应用场景
      • 📝 站长洞察 (Editor’s Insight)

HY-Motion 1.0

HY-Motion 1.0的主要功能

  • 文本驱动动作生成:通过自然语言描述直接生成高质量的3D骨骼动画,实现从文本到动作的高效转化。

  • 多样化动作覆盖:涵盖6大类超200种动作,包括基础位移、体育竞技、社交休闲、游戏角色动作等,满足多种场景需求。

  • 高质量动作输出:支持SMPL-H骨骼格式,生成的动画流畅自然,动作细节丰富,适用于高要求的动画制作。

  • 主流工具兼容:直接兼容Blender、Unity、Unreal Engine等主流3D工具,方便用户快速集成和使用。

  • 灵活的输出选项:支持原子动作、组合序列及并发动作生成,满足不同复杂度的动画需求。

  • 开源与易用性:提供完整的推理代码、预训练模型权重和详细文档,支持多种操作系统,易于上手。

HY-Motion 1.0的技术原理

  • 基于Diffusion Transformer架构:采用先进的Diffusion Transformer(DiT)架构,结合流匹配机制,能高效地将文本描述转化为高质量的3D骨骼动画。

  • 全阶段训练策略:模型通过三个阶段的训练优化性能:在超3000小时多样化动作数据上进行预训练,以学习广泛的动作模式;在400小时精选高质量数据上进行微调,提升动作精度;最后通过强化学习结合人类反馈和奖励模型进行优化,确保生成动作的自然性和准确性。

  • 流匹配机制:利用流匹配技术,模型能更好地捕捉动作数据中的连续性和动态变化,生成更加流畅和自然的动画。

  • 多模态融合:将文本模态与动作模态进行深度融合,通过文本编码器将文本描述转化为特征向量,再与动作生成器结合,实现精准的动作生成。

  • 强化学习优化:引入强化学习机制,结合人类反馈和奖励模型,对生成的动作进行评估和优化,进一步提升模型的动作生成质量和指令遵循能力。

HY-Motion 1.0的项目地址

  • 项目官网:https://hunyuan.tencent.com/motion
  • Github仓库:https://github.com/Tencent-Hunyuan/HY-Motion-1.0
  • Huggingface模型库:https://huggingface.co/tencent/HY-Motion-1.0
  • arXiv技术论文:https://arxiv.org/pdf/2512.23464

HY-Motion 1.0的应用场景

  • 影视动画制作:快速生成角色动作,降低动画制作成本和时间,提升创作效率。

  • 游戏开发:为游戏角色提供多样化动作,增强游戏体验,适配不同游戏场景。

  • 虚拟主播与数字人:生成自然流畅的动作,提升虚拟形象的互动性和真实感。

  • 教育与培训:创建教学动画,模拟复杂动作过程,辅助教学和培训。

  • 广告与营销:制作个性化动画广告,吸引观众注意力,提升营销效果。

  • VR/AR应用:为虚拟现实和增强现实内容生成实时动作,增强沉浸感。

📝 站长洞察 (Editor’s Insight)

HY-Motion 1.0的发布,标志着AIGC在专业3D动画领域的“最后一公里”正在被打通。它不仅仅是又一个“文生图”工具的变体,而是瞄准了工业流程中最高门槛的环节——角色动作生成。其核心价值在于“端到端”的简化:从文本语义直接映射到符合物理与美学规律的骨骼运动,这背后是万亿token级别的多模态数据训练与人类反馈强化学习(RLHF)的深度应用。此举将极大降低中小团队与独立开发者的动画创作门槛,并可能催生“动态内容UGC”的新业态。长远看,当动作生成变得廉价且智能,虚拟世界的交互真实感将迎来质的飞跃,为元宇宙、具身智能等前沿领域提供关键的“行为引擎”。腾讯此次开源,不仅是对开源社区的贡献,更是为其自身云与数字生态构筑了一条深厚的护城河。