惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

阮一峰的网络日志
阮一峰的网络日志
Jina AI
Jina AI
GbyAI
GbyAI
D
DataBreaches.Net
人人都是产品经理
人人都是产品经理
Hugging Face - Blog
Hugging Face - Blog
V
Visual Studio Blog
P
Proofpoint News Feed
The Cloudflare Blog
H
Help Net Security
MyScale Blog
MyScale Blog
T
The Blog of Author Tim Ferriss
量子位
博客园 - 聂微东
Apple Machine Learning Research
Apple Machine Learning Research
T
Tailwind CSS Blog
博客园 - 三生石上(FineUI控件)
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
MongoDB | Blog
MongoDB | Blog
Last Week in AI
Last Week in AI
大猫的无限游戏
大猫的无限游戏
小众软件
小众软件
月光博客
月光博客

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
获1050万美元种子投资,一张照片生成数字人物,AI视频聊天成...
扬帆出海 · 2025-12-29 · via 人人都是产品经理

Sora 聚焦 AI 视频生成,而初创公司 Lemon Slice 另辟蹊径,凭单图生成交互式会话视频角色的核心能力斩获千万美元融资。它推动 AI Agent 从文本交互迈向视频交互新形态,为企业服务、内容创作等场景注入全新可能,重塑 AI 交互的价值边界。

今年下半年,Sora的出现再次将AI视频推至全球讨论的焦点。基于用户提供的图像信息,AI能够复刻人物形象,并生成高度逼真的视频内容,生成式视频能力的边界被进一步延展。

随着AI“生成”能力不断成熟,视频是否能够进一步承载更高层级的智能驱动机制,正在成为行业关注的新方向。近日,一家创立约一年的初创AI公司Lemon Slice获得了由Matrix Partners、Y Combinator领投的1050万美元(折合人民币约3.41亿元)种子投资。与Sora聚焦的生产AI视频内容不同,Lemon Slice的方向,是将单一静态图像转化为完全交互式的会话视频角色,重点是在人与AI的交互。

Lemon Slice由Lina Colucci、Sidney Primas和Andrew Weitz联合创立。三位创始人均长期深耕机器学习与产品落地,曾共同或分别创办机器学习技术服务与产品型公司,其中,已有项目实现年收入数百万美元规模,为团队提供了从算法研发到商业化变现的完整经验。

当产品需要进一步切入教育、企业培训、客户服务等场景,Lemon Slice对“虚拟数字人”的押注,可看作是在尝试回答一个问题:在视频生成能力已经能够复刻现实之后,AI的下一步进化方向在哪里?

要理解这一逻辑,需要将视角从视频生成本身,切换到AI Agent的进化路径上。

AI Agent进化:从“文本回复”到“Video Agent”

过去两年,AI Agent已经从实验室概念快速渗透进各类商业形态中。Gartner 预计,到2026年约有40%的企业应用将集成任务型AI代理(agentic AI)功能,这一比例远高于当前水平。这种潜在的渗透速度,表明智能代理正逐渐从辅助工具向能够执行复杂任务的功能模块演进。

图源:Gartner(2025年8月)

与此同时,Gartner还预测,到2030年约80%的企业软件与应用将具备多模态AI能力。这意味着未来企业级交互将不仅依赖文本和语音,还会涵盖图像、视频等多种交互形式,从而推动更丰富的用户体验和业务流程革新。在这种趋势下,交互效能本身开始成为影响AI应用深度与长期留存的重要变量。

当前,大多数AI Agent仍以文本或语音作为主要交互方式。尽管文本在信息组织与传播成本方面具备优势,但在建立用户信任、情感反馈和长期使用粘性方面存在一定局限,特别是在教育辅导、心理咨询、客户服务等对交互质量要求较高的场景中,这种局限性更为显著。

多项行业观察显示,相较于纯文本互动,视觉反馈与情感化的互动媒介更有助于信息理解和心理投入,这也是业界开始重新审视视频、动态形象等更实时交互内容的根本原因之一。

在这一背景下,视频从“内容消费载体”逐步转向可能的“交互载体”。它不仅承载信息输出,还能同时反映表情、肢体语言与语音语调,这些因素共同拉近了人与AI之间“能看得到”的距离。当AI Agent不再是单向的问答系统,而是具备“被观察、被对话”的形态时,交互本身便成为了新的竞争变量。

一张图即可创建数字人物,还能让AI与AI面对面聊?

如果说AI Agent的上半场是在比拼“大脑”的智商,那么以Lemon Slice为代表的公司则试图在“感官层”建立差异化。目前,平台支持用户创建写实风格、卡通风格等各种类型的数字角色。从其产品架构来看,Lemon Slice围绕“实时可交互的视频形象”这一核心能力,拆分出了两条相对清晰的产品路径。

Lemon Slice可创建的各种风格数字角色

首先,是面向开发者与企业用户的Video Agents(视频智能体)。该产品的核心目标,并非单纯生成可展示的虚拟形象,而是为网站或应用提供一个可嵌入、可对话、可接入业务逻辑的交互界面。企业还可以通过API或嵌入式组件,将生成的视频形象直接部署到官网、产品后台或业务系统中,使其承担客服答疑、知识讲解、流程引导等角色。

其次,是面向更广泛创作者与个人用户的Creative Studio(创意工作室)。这一功能强调“低门槛”和“可玩性”,用户仅需上传一张图片和音频,便可快速生成对应的数字虚拟人,并进一步用于AI视频内容创作。

与此同时,Lemon Slice还引入了多角色同场互动的能力,允许用户生成多个AI角色,并让它们在同一场景中进行对话或互动。

支撑Lemon Slice产品功能的是其自研的Lemon Slice-2视频扩散转换器模型。在技术参数上,该模型规模为200亿,虽然在参数量级上无法与通用的超大规模多模态模型相比,但其核心竞争力在于“能效比”。据悉,通过自回归架构,它能在单块GPU上维持每秒20帧的实时生成。

在商业模式上,Lemon Slice采取了从Starter到Enterprise的分层订阅制,向个人创作者、团队以及企业开放,月订阅价格按级别依次为8美元/mo、40美元/mo、100美元/mo、240美元/mo。

给AI视频“注入灵魂”,这个“虚拟人”有何不同?

将Video Agents与Creative Studio放在同一产品体系中来看,Lemon Slice的关键在于它如何围绕实时视频交互这一能力,构建出一套可被反复调用的底层机制。

首先可以看到的是,它刻意压缩了“从想法到可用形态”的距离。无论是企业将视频智能体嵌入官网,还是个人用户在创意工作室中生成虚拟角色,同样基于单张图像完成角色生成,同样通过API或内置逻辑驱动对话与动作。这种高度统一的生成与交互流程,使产品不必为不同使用人群维护多套系统,也让视频形象更像一种“随取随用”的能力模块,而非一次性制作的内容资产。

进一步来看,Lemon Slice在场景适配上的选择,同样体现出对通用性的偏好。其视频形象并未被限定在单一用途之中,而是通过全身动作、语义驱动与背景切换,在不同场景中完成快速迁移。对企业而言,这意味着同一视频角色可以承担客服、讲解或培训等不同任务,依赖的是同一套实时生成与调度能力。

注:数字人可通过文字、语音进行交互,有肢体语言、神态

同时,多角色同场互动的设计,也进一步放大了这一能力的可扩展性。当多个AI角色能够在同一画面中进行对话时,视频开始具备多元化交互的可能性。对于内容创作而言,这提供了更丰富的表达空间。而在实际应用中,多角色之间的分工与协作,也为复杂流程的可视化呈现留下了接口。

在这些设计背后,视频并未被当作最终内容,而更像是一种持续运转的交互状态。角色的表情、动作、语音与对话逻辑被同时调度,使用户无论是“观看”还是“对话”,都处在同一个系统之内。

从这一层面来看,Lemon Slice所尝试的,更多是围绕“视频是否可以成为一种长期存在的交互形态”这一问题,给出了一个工程化的实现路径。

结语

Lemon Slice联合创始人兼CEOLina Colucci认为:“人们对人工智能虚拟形象的主要抱怨是它们缺乏真实感,降低了价值。未来,所有视频都将是互动式的,并根据观看者的需求进行个性化定制。”从这一观点出发,Lemon Slice正在围绕一个更具体的问题展开:当模型能力逐渐标准化,视频是否可以成为一种真正可被反复使用的交互形态,从单图生成、实时对话到多角色同场互动,其产品路径更像是在不断压缩“技术复杂度”与“实际可用性”之间的距离。

在这一过程中,视频不再只是内容的呈现方式,而被重新放置到交互链路之中。至于这种形态最终会在多少场景中成立,或许仍有待时间验证,但可以确定的是,围绕交互形式、用户体验、用户感官的重新设计,已经开始成为AI应用中不可回避的一部分。

本文由人人都是产品经理作者【扬帆出海】,微信公众号:【扬帆出海】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图来自Unsplash,基于 CC0 协议。