惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

M
MIT News - Artificial intelligence
WordPress大学
WordPress大学
GbyAI
GbyAI
S
SegmentFault 最新的问题
量子位
爱范儿
爱范儿
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
MyScale Blog
MyScale Blog
人人都是产品经理
人人都是产品经理
博客园 - 叶小钗
aimingoo的专栏
aimingoo的专栏
V
Visual Studio Blog
U
Unit 42
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
The Cloudflare Blog
Stack Overflow Blog
Stack Overflow Blog
博客园 - 聂微东
J
Java Code Geeks
The GitHub Blog
The GitHub Blog
Y
Y Combinator Blog
IT之家
IT之家
Martin Fowler
Martin Fowler
宝玉的分享
宝玉的分享
雷峰网
雷峰网

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
AIGC在视频生成领域究竟有多大的想象空间?
只A不I · 2023-11-29 · via 人人都是产品经理

AI技术正在视频内容生成领域发挥着越来越大的作用,那么当下,各家产品们的AI视频生成能力表现得如何?AIGC在视频生成领域的发展,未来又有着怎样的想象空间?一起来看本文的分享。

AIGC在视频内容生成的赛道上才刚刚起步。

上周二Stable Video Diffusion(SVD)模型的发布在行业内引起热议,SVD模型主要提供图片生成视频能力。在短视频的时代,谁能不对智能视频内容生成能力感到兴奋呢?那AI视频生成能力现在如何能为我们所用,未来会有多大的想象空间呢?

从产品类型区分,AIGC视频生成产品可以分为:

  1. 数字人合成视频:以数字人搭配对话的形式为视频内容主题,数字人可以为个人真实形象或者是虚拟人物形象;
  2. 图文生成视频:通过输入图片搭配文字描述生成以图片内容为主题的扩展视频;
  3. 素材合成:通过文字描述,在素材库或网络中检索匹配的视频或者图片内容,组合成一部视频。

一、数字人合成视频

通过个人形象+动作+声音合成视频,视频内的相关元素均可通过视频录制上传后制作成为模板。适用于视频内容相对固定,视频形式以真人+讲解的场景,例如广告宣传、知识讲解等。

以下是通过HeyGen生成的视频片段,两个形象均为数字虚拟人,从产品效果看,数字人的形象、动作、音色的还原度均非常高。

前阵子非常火热的外语对嘴型视频也可以通过HeyGen进行制作,只要上传视频并选择需要翻译的语言,就可以将原视频音频的语言翻译为指定的另一门语言,并将视频中人物发音的嘴型对应上。

二、图文生成视频

通过图片+文字描述生成视频。由于文字控制的自由度过高,随着视频时间的增加,视频内容的质量目前很难保证(且随着AI模型对视频内容记忆的增加,视频生成将消耗大量的硬件资源),目前适用于制作5秒以内的短视频(动态图),作为静态图片的延展。

但人类对于AI的幻想从来都不会局限在仅仅几秒的时间内。Runway在8月推出了Watch功能,展示了分钟级别的作品,目前已有60多个作品。虽然中长视频制作的功能暂未开放,但已有的作品为我们展示了AI在未来的可想象性。

以下视频是Runway的Watch功能里片段,除了人物镜头拉远后身体细节会出现一些扭曲外,视频整体的质量已经相当不错。

三、素材合成

通过文字描述在已有的素材库中选择合适的视频及图片素材进行匹配,文字描述将作为字幕展示,再选择音色对字幕进行配音。这种应用方式从视频的角度是生成,而从素材的角度更多是进行合成。由于素材是从已有素材库提取,故视频质量相对可控。适用于素材较多的视频制作场景。

以下是通过剪映文字成片功能制作的视频片段,视频内容整体的流畅度与文字描述关联较大,但有部分素材与文字描述不符,受限于素材库的素材量。

四、未来展望

从目前的产品形态以及生成质量上看,AIGC在视频生成领域的发展,还远未达到批量消费级内容生产的阶段。受限于机器资源、内容丰富度、使用场景等因素,视频生成能力还需要经过很长时间的打磨。

在未来,集成了三类视频生成能力的工具可能会推动AI生成视频走向消费级别。我们可以先定义好人物形象、声音、动作,再从素材库检索并添加已有的素材,最后根据文字描述决定故事情节的走向。或许有一天,所有人都可以成为一名AI电影导演。

本文由 @只A不I 原创发布于人人都是产品经理。未经许可,禁止转载。

题图来自Unsplash,基于 CC0 协议

该文观点仅代表作者本人,人人都是产品经理平台仅提供信息存储空间服务。