惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Last Week in AI
Last Week in AI
有赞技术团队
有赞技术团队
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
人人都是产品经理
人人都是产品经理
博客园 - 司徒正美
博客园 - 聂微东
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
博客园 - 叶小钗
罗磊的独立博客
IT之家
IT之家
博客园 - 三生石上(FineUI控件)
V
Visual Studio Blog
T
Tailwind CSS Blog
大猫的无限游戏
大猫的无限游戏
Hugging Face - Blog
Hugging Face - Blog
H
Hackread – Cybersecurity News, Data Breaches, AI and More
N
Netflix TechBlog - Medium
MyScale Blog
MyScale Blog
J
Java Code Geeks
L
LangChain Blog
S
SegmentFault 最新的问题
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
Apple Machine Learning Research
Apple Machine Learning Research
G
Google Developers Blog

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
刚刚,谷歌深夜上新Veo 3.1!网友狂刷2.75亿条,Sora 2要小心了
新智元 · 2025-10-17 · via 人人都是产品经理

谷歌凌晨推出视频生成模型 Veo 3.1,新增强叙事音频控制、首尾帧参考等功能,接入 Gemini API 与 Vertex AI,普通用户可通过 Flow 或 Gemini 体验。文章测试其生成效果,提及 Flow 平台用户已生成超 2.75 亿个视频,并对比分析该模型与竞品的优劣势及未来发展预期。

 新智元报道  编辑:定慧【新智元导读】谷歌凌晨更新Veo 3.1,主打更强叙事与音频控制、首尾帧与多图参考等精控,接入Gemini API与Vertex AI,Flow与Gemini可用。可合成多人物场景、音画同步,片段最长约148秒;规格至1080p/24fps。

刚刚,谷歌在今天凌晨更新了旗舰视频生成模型Veo 3.1。

此次更新主要有两大功能亮点:

更强的叙事与音频控制

更丰富的输入与编辑能力

这次升级让AI对想讲述的故事能有更深的理解。

Veo 3.1让AI视频生成迈入「导演级」精控阶段。

真实与叙事感升级,更高画质与音画同步,让视频更具电影质感。

Veo 3.1目前已接入Gemini API与Vertex AI。

普通用户也可以直接在Flow或者Gemini中体验。

Flow使用方式如下,新建项目后即可使用。

Gemini可选择创建Video,即可使用Veo 3.1。

我们使用「威尔斯吃面」极简提示词测试了一下效果,确实已经非常流畅和自然。

对于首尾帧生成,我们也进行了测试,提示词为「奥特曼最后像钢铁侠一样飞走」。

效果也非常好。

Veo 3.1可以将不同人物和物体的照片合成一个完整的场景,并配有声音。

还能创建更长的片段,甚至持续一分钟或更久,延续原始镜头中的动作。

每个生成的视频都基于前一个片段的最后一秒,以帮助延续故事,并保持背景和人物的一致性。

只需提供第一帧和最后一帧,Veo就会让整个场景栩栩如生,创建带有宏大转场的无缝视频。

强推使用Flow来使用和体验Veo 3.1!

5个月前,谷歌正式推出Flow,一款由Veo驱动的AI电影制作

目前,谷歌宣称用户已在Flow中生成了超过2.75亿个视频!

此次Veo 3.1的更新,推出了用于剪辑编辑的新功能和增强创意能力。

Flow还有一个Flow TV的功能,像一个电视台一样,可以不断地换台,观看其他用户生成的创意视频。

Flow TV工作台可以通过工作台进行切换。

Flow将2.5亿个视频,分成了不同的频道。

比如碰撞测试、打招呼、感到可爱。。。等等。

而Short Films则是用户制作的微电影,制作更加精良,时间更长。

目前只放出了3部。比如下面这部名为「FreeLancers」,讲述了这样一个故事:在纽约一家秘密餐厅的晚餐中,两位久疏音信的养兄弟——一位做事谨慎、另一位喧闹且卤莽——回忆起他们作为国际杀手的职业生涯,直到他们意识到两人竟被雇佣去执行同一项任务:对方。

「FreeLancers」电影级别视频如下,电影质感非常高。

Veo 3.1技术规格上支持输出720p或1080p分辨率的视频,帧率为24帧/秒(fps)。

视频时长可选4秒、6秒或8秒,若使用Extend功能,视频最长可扩展至148秒。

各位觉得Veo 3.1的效果能不能打过Sora 2呢?

这次的Veo 3.1更像「功能小升级」——新增首尾帧、多图参考等控制。

但成片质感较Veo 3进步有限,甚至略微显得有点「假」。

原生时长仍只有8秒,Flow延长至30秒画面偶有衔接,音频提升其实很一般。

基础物理表现比过去好些,但一遇到人物表演与复杂调度还是会露馅。

但这个只是Veo 3->Veo 3.1的一次微调。

期待一下谷歌年底的大招,估计会配合Gemini 3全家桶发布。

本文由人人都是产品经理作者【新智元】,微信公众号:【新智元】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图来自Unsplash,基于 CC0 协议。