惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

T
The Blog of Author Tim Ferriss
罗磊的独立博客
月光博客
月光博客
GbyAI
GbyAI
腾讯CDC
G
Google Developers Blog
H
Hackread – Cybersecurity News, Data Breaches, AI and More
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
U
Unit 42
Engineering at Meta
Engineering at Meta
A
About on SuperTechFans
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
aimingoo的专栏
aimingoo的专栏
C
Check Point Blog
Y
Y Combinator Blog
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
Microsoft Azure Blog
Microsoft Azure Blog
I
InfoQ
雷峰网
雷峰网
B
Blog RSS Feed
美团技术团队
M
MIT News - Artificial intelligence
有赞技术团队
有赞技术团队
D
Docker

Prompt 语宙

kimi-thinking-preview – 月之暗面推出的多模态思考模型 pdf-craft – 开源 PDF 转 Markdown 工具 UltraMem – 字节豆包大模型团队推出的全新超稀疏模型架构 EasyControl – Tiamat AI 联合上海科大等开源的图像生成控制框架 GaussianCity – 南洋理工大学 S-Lab 团队推出的 3D 城市生成框架 X-Prompt – 用于多模态视频目标分割的通用框架 豆包大模型1.5 – 字节跳动推出的最新版大模型 GaussianAnything – 南洋理工 S-Lab 和上海 AI Lab 等推出的 3D 生成框架 Cube 3D – Roblox 推出的 AI 3D 生成模型 OpenMath-Nemotron – 英伟达开源的数学推理系列模型 MAI Transcribe-1.5 – 微软 MAI 推出的语音转文本模型 Seed1.5-Embedding – 字节跳动 Seed 团队推出的向量模型 2026世界杯人机大战引爆!联想携手DeepSeek等顶尖AI大模型,对战亿万球迷预测冠军 高考公平守护战!豆包、文心等主流大模型集体禁用拍题功能 ShotAdapter – Adobe联合UIUC推出的多镜头视频生成框架 Devstral – Mistral AI联合All Hands AI开源的编程专用AI模型 MMaDA – 字节联合普林斯顿大学等推出的多模态扩散模型 Software Copyright Materials Skill – 开源软著资料生成Skill Dulus – 开源的 CLI AI Agent,可驱动多模型工具调用 Reasonix – 专为 DeepSeek 推出的开源终端编程 Agent Mega-ASR – NTU、NUS、上海AI Lab开源的语音识别模型 CodeGraph – 开源代码知识图谱工具,加速代码理解和分析 MiniCPM5-1B – 面壁智能联合清华开源的端侧文本基座模型 Horizon – 开源 AI 信息聚合系统,构建专属新闻雷达 BitCPM-CANN – 面壁智能联合清华开源的端侧大模型 Xiaomi Auto World Model – 小米推出的辅助驾驶世界模型 opera-browser-cli – Opera Neon 开源的命令行工具 omp – 开源的 AI 终端编程智能体,能与 IDE 深度联动 Claude Opus 4.8 – Anthropic 推出的旗舰级大语言模型 Hy-Memory – 腾讯混元推出的 Agent 记忆插件
PersonaLive开源:澳门大学重磅发布,12G显卡跑无限时长AI直...
站外新闻 · 2026-06-14 · via Prompt 语宙

💡 站外导读:当数字人直播因高硬件门槛、显存爆炸和音画不同步等问题仍停留在概念演示阶段时,澳门大学与GVC实验室联合开源的PersonaLive打破了僵局。这款工具仅需一张12GB显存的消费级显卡,即可实现无限时长的实时肖像动画生成,将AI主播带货、虚拟形象参会等应用场景的落地成本大幅拉低,直击行业规模化普及的核心痛点。

PersonaLive 是澳门大学和 GVC 实验室开源的实时数字人直播工具。工具能在单张 12GB 显存的消费级显卡上运行,实现无限时长的肖像动画生成,支持低延迟互动。PersonaLive通过优化显存管理和 TensorRT 加速,解决了传统数字人直播的高硬件门槛、显存爆炸和音画不同步等问题。PersonaLive 能轻松实现AI 主播带货和虚拟形象参会,为数字人直播领域带来新的可能性。

  • PersonaLive是什么
  • PersonaLive的主要功能
  • PersonaLive的技术原理
  • PersonaLive的项目地址
  • PersonaLive的应用场景
      • 📝 站长洞察 (Editor’s Insight)

PersonaLive

PersonaLive的主要功能

  • 低硬件要求:仅需单张 12GB 显存的消费级显卡(如 RTX 3060、4070 等),大幅降低入门门槛。

  • 无限时长生成:支持连续生成视频流,适合长时间直播,解决传统模型显存爆炸和时序不一致问题。

  • 低延迟与实时互动:通过优化显存管理和推理加速,支持 TensorRT 加速,实现音画同步和即时互动。

  • 生态友好:支持 ComfyUI 和 RTX 50 系列显卡,紧跟硬件和社区潮流。

  • WebUI 可视化操作:提供简单易用的 Web 界面,方便用户上传照片、调整参数和实时生成动画。

PersonaLive的技术原理

  • 流式 Diffusion 框架:基于扩散模型(Diffusion Model),通过优化显存管理和推理加速,实现连续视频流的生成,而非传统的分段视频生成。

  • 显存优化:工具采用高效的显存管理技术,确保在有限的显存下长时间稳定运行,避免显存溢出。

  • 时序模块:引入特殊的时序模块,支持无限时长的视频流生成,适合长时间直播场景。

  • TensorRT 加速:支持将模型转换为 TensorRT 格式,推理速度提升约 2 倍,显著降低延迟。

PersonaLive的项目地址

  • GitHub仓库:https://github.com/GVCLab/PersonaLive
  • HuggingFace模型库:https://huggingface.co/huaichang/PersonaLive
  • arXiv技术论文:https://arxiv.org/pdf/2512.11253

PersonaLive的应用场景

  • AI 虚拟主播:用于电商直播、新闻播报和娱乐直播,实现低成本、高质量的 24 小时不间断虚拟人物直播。

  • 虚拟会议与远程协作:在视频会议和远程教学中提供虚拟形象,保护隐私并增强互动体验。

  • 内容创作与娱乐:工具能助力短视频、电影、游戏等内容创作,丰富形式并提升制作效率。

  • 客户服务与支持:支持打造虚拟客服和智能助手,实现 24 小时在线服务,提升客户体验。

  • 教育与培训:生成虚拟教师和培训模拟场景,提供个性化、高效的教学与培训服务。

📝 站长洞察 (Editor’s Insight)

PersonaLive的发布标志着实时数字人创作正从’技术验证’迈向’桌面实用化’。其核心价值在于将Sora级扩散模型通过流式推理框架和显存优化’下放’到消费级硬件,这呼应了当前AI产业’轻量化、工具化’的明确趋势——未来竞争焦点不仅是模型能力,更是部署成本与用户体验。结合TensorRT加速和ComfyUI生态支持,它实质上构建了一个从创作到直播的短链路工作流。在电商、教育、泛娱乐对虚拟身份需求井喷的背景下,这类降低创作门槛的开源工具,将成为催生’全民数字分身’时代的关键基础设施,其社区演化潜力值得长期关注。