惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Y
Y Combinator Blog
GbyAI
GbyAI
U
Unit 42
WordPress大学
WordPress大学
Last Week in AI
Last Week in AI
P
Proofpoint News Feed
D
DataBreaches.Net
N
Netflix TechBlog - Medium
H
Hackread – Cybersecurity News, Data Breaches, AI and More
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
C
Check Point Blog
Martin Fowler
Martin Fowler
月光博客
月光博客
MongoDB | Blog
MongoDB | Blog
MyScale Blog
MyScale Blog
The Cloudflare Blog
Apple Machine Learning Research
Apple Machine Learning Research
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
M
MIT News - Artificial intelligence
云风的 BLOG
云风的 BLOG
罗磊的独立博客
B
Blog RSS Feed
J
Java Code Geeks
The GitHub Blog
The GitHub Blog

少数派

派早报:Google 发布 Fitbit Air 等 - 少数派 「新人报到」確認需求,再開始 - 少数派 从 SOLO 独立开发者社区,我看到了越来越多开发者开始做自己的产品 - 少数派 我怎么管理那些"不常做,但总会忘"的生活事项 - 少数派 人形机器人量产元年,数据才是具身智能的“生死线” - 少数派 BuhoLaunchpad 高度还原 Mac 启动台:开发历程与思考 - 少数派 五年陪伴依然不舍,DIY 换壳后让罗技 MX Master 3 继续服役 - 少数派 新玩意 240|少数派的编辑们最近买了啥? - 少数派 一日一技|为什么你应该关闭 iOS 的键盘声音 - 少数派 我做了个插件和 Skills,一键提取任何网站的设计规范 Design.md - 少数派 住在三四线城市的你,该开始录播客了 - 少数派 甘南秘境,大白高国 - 少数派 AI的审美:谁让把我变成川内倫子 - 少数派 返工怎能不烦恼,打工人片单总有一部是你的「嘴替」 - 少数派 为了让「上厕所」更健康,我做了一个小工具 - 少数派 AI + Skill,能够让生成的文章去除 AI 味吗? - 少数派 新玩意|韶音OpenDots ONE 耳夹式耳机 - 少数派 《美满》| 在每一个春天的晚上相爱(362) - 少数派 新玩意|优篮子 PS01 MagSnap 磁吸支架 - 少数派 自我整合手记 | 我开始早睡了:用稳定规则,为自由托底 - 少数派 用龙虾(OpenClaw)两个多月,我最深的12个体会 - 少数派 听歌时间到,12 张你可能错过的 2025 华语乐坛好专辑 - 少数派 承诺能追吗 - 少数派 macOS 26启动台没了? 我做了个不一样的App启动器 - Keboard - 少数派 《四海为家的人》| INTJ对话INTJ(361) - 少数派 你发过的那些黑历史,是时候一次清干净了 - 少数派 新玩意:安安静静玩,越玩越专注:计客密码机 - 少数派 iPad 用户首次体验 Android 平板:vivo Pad6 Pro - 少数派 数据逻辑强 - 少数派 极北行+ | 一路向北,探访日本至北之地 | 001 - 少数派
让 AI 视频创作更丝滑:我做了一个一站式视频&图片创作平台 -...
2026-04-07 · via 少数派

过去一年,我花了很多时间在用各种 AI 内容生成工具。

一开始是图像生成,后来开始用视频模型,再到尝试把它们组合起来做完整内容。但用得越多,一个问题就越明显:

工具越来越强,但创作流程反而越来越碎。

一个真实的创作流程,其实很“割裂”

举个很常见的例子。

如果你想做一条完整的内容(比如一个短视频),通常会是这样:

用一个工具生成图片(角色 / 场景 / 封面)

再换一个工具,把图片变成视频

如果效果不对,回到图片工具重新生成

再导入视频工具继续尝试

中间还可能夹杂:

prompt 的反复修改

素材的来回导出 / 导入

不同模型之间的风格不一致

每个工具都不差,但组合起来就变得很不顺

这也是我一开始觉得最“反直觉”的地方:

AI 已经在帮我们减少创作成本,但工具之间的割裂,又把成本加回来了。

一个简单的想法:能不能把流程合在一起?

我后来一直在想一个问题:

如果把 AI 图片生成和 AI 视频生成,当作同一条创作链路的不同阶段,会怎么样?

也就是说,不再把它们当成两个独立工具,而是:

图片 → 是视频的起点

视频 → 可以反过来影响图片

prompt 和参考内容 → 在整个过程中持续复用

基于这个想法,我做了一个工具: 👉 https://veogen.art

AI 视频生成

我在 Veogen 里尝试解决的,其实是“连续性”

和很多 AI 工具不同,我没有优先去做“更强的模型”,而是先关注一件事:

创作过程能不能更连续?

在 Veogen 里,我尽量把常见的创作路径放在一个统一空间里:

文本 → 图片

图片 → 视频

文本 → 视频

图片 → 图片(编辑 / 重绘)

视频 → 视频(变化 / 延展)

重点不是“功能覆盖”,而是:

👉 这些操作之间是可以顺着走的,而不是被迫中断。

比如一个很典型的流程:

先生成一张满意的图

直接把它作为参考生成视频

不满意 → 调整 prompt 或参考图

继续生成下一版

整个过程不需要切换工具,也不需要重新整理素材。

一个被低估的问题:AI 创作其实是“迭代过程”

很多人第一次接触 AI 工具,会觉得:

输入 prompt → 得到结果

但用得多之后就会发现:

真正的过程是:反复尝试 → 微调 → 对比 → 再生成

也就是说,AI 创作更像是一个“迭代系统”,而不是一次性输出。

但目前很多工具的设计,还是偏“一次生成”:

每次都是新的开始

上下文不连续

很难复用之前的结果

我在 Veogen 里做的一个小尝试是:

👉 让图像、视频、prompt、参考内容尽量在同一个上下文里流动

虽然还不完美,但确实能减少一些“重复劳动”。

关于模型这件事,我的取舍

另一个我反复权衡的点是:

要不要只做一个模型?

最后的选择是:不做。

原因很简单:

不同模型有不同优势

创作场景也很多样

用户本来就会“混用工具”

与其强行统一,不如:

👉 把多个模型放进一个更顺的工作流里

让用户可以在同一个地方:

尝试不同模型

对比结果

快速切换思路

这比单一模型更接近真实使用场景。

关于价格的一点现实考虑

AI 工具的另一个痛点,其实是成本。

我自己在用这些工具时的感受是:

订阅太多,很容易叠加成本

按量付费,又很难预估

所以在 Veogen 里,我用了一个比较折中的方式:

订阅(适合持续使用)

点数补充(应对高频需求)

至少在我自己的使用习惯里,这种方式会更灵活一点。

写在最后

做 Veogen 的过程,其实让我对一件事有了更清晰的认识:

AI 工具的下一步,可能不是“更强”,而是“更顺”。

当能力逐渐趋同时,真正影响体验的,反而是:

工作流是否连贯

上下文是否连续

创作成本是否可控

Veogen 只是我在这个方向上的一个尝试。

如果你也在用 AI 做内容创作,或者正被多工具切换搞得有点烦,可以试试看这个思路: 👉 https://veogen.art