惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

D
Docker
阮一峰的网络日志
阮一峰的网络日志
T
Tailwind CSS Blog
博客园 - 【当耐特】
量子位
博客园 - 叶小钗
有赞技术团队
有赞技术团队
Jina AI
Jina AI
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
博客园 - Franky
博客园 - 司徒正美
爱范儿
爱范儿
美团技术团队
小众软件
小众软件
酷 壳 – CoolShell
酷 壳 – CoolShell
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
V
V2EX
罗磊的独立博客
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
Last Week in AI
Last Week in AI
Hugging Face - Blog
Hugging Face - Blog
I
InfoQ
D
DataBreaches.Net
宝玉的分享
宝玉的分享

分享创造

[发 15 个码] 开发的 Mac 应用 分享 KCase 脑图测试用例生成平台(AI 辅助生成测试用例) 标签页囤积症自救:写了个插件 TabRack,主打快速检索、自动分类和 AI 摘要 [file-preview]一个比较全面的在线文件预览组件库-支持 react 和 vue 撸了个 iOS 小应用[极简水印相机],直接免费 做了一个 V2EX Skill 写了个 iOS 打码 App「遮鸭 Maskduck」,纯离线免费 35 岁前端,裁员失业后,我花 1 个月做了个 AI 生图网站 亲身经历猫咪急症,我做了一款猫狗疼痛检测工具,希望能救你家毛孩一命 如何用 AI 做比较酷炫的落地页? 求真!最近 AI 生图的能力强到可怕 开源一个查看 k8s 的菜单栏工具-kubebar Packpour:我做了个专门给 App Store Connect 填多语言元数据的小工具 面对 140 年一遇的超级厄尔尼诺,我做了个全球监测小站 做了一个自动翻译的 Hacker News 客户端 做了一个 AI 头像生成器,可以免费生成 2 次 [送码 50 个] 自己手搓了个高颜值的倒数日 App——拾光机,求 V 友们指点 一个将苹果健康 APP 数据导出的工具,然后把你的数据喂给 AI 分析 我做了一个叫「订阅斩」的 iOS App,专门对付那些悄悄扣钱的订阅 做了个草率的日麻互动漫画,听听反馈 喜欢自己洗车的朋友们,我用 ai 做了一款洗车小程序 -- 洗车志 感谢 V2EX 上各位 NAS🍆 和 Datahoarder 玩家的关注和真实反馈!作为个人开发者,能得到这么多硬核玩家们的讨论,我非常荣幸。 用 AI 开发熊孩子自律的小程序 用 OpenClaw 搭建个人运动助手 今天摸鱼给 NanaAI 也接入了 GPT-Image-2 [Video Companion]一个 chrome 插件,解决大多对视频操作的需求~欢迎使用提 bug AI 时代,做产品简单了,把产品推广出去却变的更难了~ bestskills.dev - Skills 精选和评测站点 免 ROOT 强力卸载安卓广告软件 一个 All In One 的运维工具,支持 SSH、数据库、Redis 管理
[开源·Actionow] 包含 Agent 辅助·团队协作·多租户·积分系统...
a1ienworm · 2026-04-23 · via 分享创造

前言

V 站的各位朋友,最近做了个违背祖宗的决定,打算把从去年 12 月份开始利用业余时间和 CC 一起(主要是 CC )开发的一个 AI 影视创作平台给开源出来。给他取了个名字 [ActioNow] , 蹭一下 [TapNow] 的热度 目前包含包含以下能力: [多 Agent+自定义 Skill ] [团队实时协作] [细粒度权限控制] [多租户架构] [积分与计费系统] [ AI 模型插件化系统] [异步任务编排] 能力图

项目地址https://github.com/actionow-ai/actionow

仓库中的演示站暂时还不能使用,近期会重新上线

演示视频(与目前版本存在一些差异,整体功能上是一致的): https://b23.tv/UEQy3Gm


一、先来说说为什么打算开源:

一是、最重要的一点是在高强度 Vibe Coding 后,愈发觉得现在闭源工具平台的出路越来越窄,用 AI 只需要较低的时间和金钱成本就可以复刻出相似甚至更好的工具平台。但是,也存在一定的局限性,特别是测试的工作可能依靠人力会是比较靠谱的选择。

二是、为了兼顾自己的日常工作和 [ActioNow] 的开发天天熬大夜实在是有点顶不住了,希望可以开源分享出来让更多的人一起参与开发。


二、再来说说为什么会做这个项目:

在 25 年上半年的时候,接触到了 AI 内容这个行业,当时作为刚入门的新人一步步从 [AI 小说] 创编到 [AI 漫剧] 创作学习接触到非常多全新的知识。当时工作的切入点还是在探索 LLM 在小说创编上的可能性,当时和专业的编剧老师测试了市面上各种工具和模型得出的结论还是「不成熟」,比较难达到专业编剧老师的认可。

后来转战 [AI 漫剧] 赛道,对于生图生视频以及 LLM 模型的选择也是做过非常多的测试工作,首先是生图模型的选择:测试了 SD 系列的模型、Imagen-3.0 、Seedream 3 、Flux 系列模型的生图效果,最终选定了 [Seedream 3] 一是它的画风比较适合于国内的市场(对于国漫|日漫类型的支持效果很好),其次是发现利用它的随机种子可以较好的控制 人物|场景|道具 的一致性。

之后是生视频模型的选择:测试了 Veo 、Vidu 、Runway 、Seedance 1.0 lite 等模型,最终综合成本考虑还是以 [Seedance 1.0 lite] 作为首选。字节在这方面的功底是真的不错。

最后是 LLM 模型的选择,主要有三个方面的用途:一是用于从剧本中一次性解析出完整的 人物|场景|道具 列表、二是用于从剧集中解析出完整的分镜序列、三是通用的提示词生成|优化功能。当前考虑后还是选择了 Gemini 系列模型,在当时来看它拥有超大的上下文窗口以及 300 美刀的试用额度(当时随便拿虚拟卡就可以薅到)

在模型的测试过程中,素材的生成方式也在一步步的改变:从手工到各个模型的平台生成素材 -> python 脚本 -> 简单的工具化平台 -> 初版的一站式漫剧创作平台,这个过程花了差不多 3 个月左右。并且,在前期还全流程的参与了一整部的 AI 漫剧创作过程:编剧老师给出剧本 -> 剧本围读 -> 提出剧本修改意见 -> 素材生成技术难点确认(某些梗以及画面效果在当时是特别难生成的,需要大量的抽卡,因此会先确认是否需要)-> 按集生产素材 -> 视频剪辑(当时第一次使用剪映)-> 跟编剧老师一起审片 -> 修改 -> 发行(这部分就参与的比较少了)。当时参与的第一部漫剧的播放量达到了千万级,在此之后就专注于 [一站式漫剧创作平台] 的开发了。

但是,后面随着开发团队人越来越多加上平台有了商业化的需求,参与的也就变少了,慢慢转战 Agent 相关研究开发了。后面,随着对于 Agent 的学习研究的深入,觉得将 AI 漫剧与 Agent 结合起来是一个很好的方向,于是就有了 [Actionow] 这个项目。


三、项目愿景

我觉得 AI 不应该是取代创作者的黑箱,而应是赋能创意的助手。对于后续可能的一些发展方向规划:

  1. 基于 AI 影视创作方向不断进行功能迭代,弥补差距,类似于无限画布、在线剪辑、一键成片等功能。搭建 AI 影视创作 skill 市场,用户可以分享自己的影视创作 skill ,通过开放的 Agent 编排能力,共同探索 AI 影视创作的边界;
  2. 从现有系统中抽象出一套企业级、可扩展、易于二次开发的 SaaS 模版框架。从多租户架构到模型插件化网关再到计费闭环。

希望可以通过开源协作,将 [ActioNow] 打造成一个汇聚创意与技术的项目。当然,目前也还没有特别明确的计划,希望大家可以给给建议。 大家在 AI 影视创作上有什么想要了解的,我也可以基于自身的经验帮忙解答。 项目目前仍然处于开发初期,还有非常大量的测试工作需要进行,欢迎多多提 issue !