惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

The GitHub Blog
The GitHub Blog
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
Microsoft Security Blog
Microsoft Security Blog
J
Java Code Geeks
S
SegmentFault 最新的问题
Apple Machine Learning Research
Apple Machine Learning Research
N
Netflix TechBlog - Medium
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
博客园_首页
宝玉的分享
宝玉的分享
Google DeepMind News
Google DeepMind News
B
Blog RSS Feed
Hugging Face - Blog
Hugging Face - Blog
量子位
Blog — PlanetScale
Blog — PlanetScale
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
阮一峰的网络日志
阮一峰的网络日志
D
Docker
罗磊的独立博客
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
云风的 BLOG
云风的 BLOG
IT之家
IT之家
MyScale Blog
MyScale Blog
Microsoft Azure Blog
Microsoft Azure Blog

分享创造

分享 KCase 脑图测试用例生成平台(AI 辅助生成测试用例) 标签页囤积症自救:写了个插件 TabRack,主打快速检索、自动分类和 AI 摘要 [file-preview]一个比较全面的在线文件预览组件库-支持 react 和 vue 撸了个 iOS 小应用[极简水印相机],直接免费 做了一个 V2EX Skill 写了个 iOS 打码 App「遮鸭 Maskduck」,纯离线免费 35 岁前端,裁员失业后,我花 1 个月做了个 AI 生图网站 亲身经历猫咪急症,我做了一款猫狗疼痛检测工具,希望能救你家毛孩一命 如何用 AI 做比较酷炫的落地页? 求真!最近 AI 生图的能力强到可怕 开源一个查看 k8s 的菜单栏工具-kubebar Packpour:我做了个专门给 App Store Connect 填多语言元数据的小工具 面对 140 年一遇的超级厄尔尼诺,我做了个全球监测小站 做了一个自动翻译的 Hacker News 客户端 做了一个 AI 头像生成器,可以免费生成 2 次 [送码 50 个] 自己手搓了个高颜值的倒数日 App——拾光机,求 V 友们指点 一个将苹果健康 APP 数据导出的工具,然后把你的数据喂给 AI 分析 我做了一个叫「订阅斩」的 iOS App,专门对付那些悄悄扣钱的订阅 做了个草率的日麻互动漫画,听听反馈 喜欢自己洗车的朋友们,我用 ai 做了一款洗车小程序 -- 洗车志 感谢 V2EX 上各位 NAS🍆 和 Datahoarder 玩家的关注和真实反馈!作为个人开发者,能得到这么多硬核玩家们的讨论,我非常荣幸。 用 AI 开发熊孩子自律的小程序 用 OpenClaw 搭建个人运动助手 今天摸鱼给 NanaAI 也接入了 GPT-Image-2 [Video Companion]一个 chrome 插件,解决大多对视频操作的需求~欢迎使用提 bug AI 时代,做产品简单了,把产品推广出去却变的更难了~ bestskills.dev - Skills 精选和评测站点 免 ROOT 强力卸载安卓广告软件 一个 All In One 的运维工具,支持 SSH、数据库、Redis 管理 [开源] Codeg V0.10:专注于代码生成的多智能体 IDE(cc、codex、gemini、opencode……),新版本重构了工作区,飞一般的体验,支持桌面端、服务器部署
我做了一个把网文自动变成动漫短视频的工具,但不确定有没有...
v2reach · 2026-05-17 · via 分享创造

它做什么

一句话:网文作者上传小说章节 → 自动生成 3-5 分钟的日系动漫风格短视频。

具体 pipeline:

  1. 豆包 LLM 解析文本 → 提取角色、场景、对话、自动分镜
  2. Seedream 按分镜生成动漫画面(参考图保持角色一致性)
  3. Seedance 2.0 图生视频 + 环境音效
  4. 火山引擎 TTS 多角色配音
  5. FFmpeg 合成字幕 → 导出 1080p MP4

整套跑下来一集成本约 ¥9-19(用户自备火山方舟 API Key ),不需要 GPU ,纯编排代码。

跟现有方案的区别

  • 即梦/可灵/Vidu:通用视频生成,没有角色一致性概念,理解不了长篇叙事
  • NovelAI:能出图但需要大量手动操作,不是端到端
  • 小说推文工具:本质是 PPT 翻页配 AI 配音,没有动画

这个项目想做的是「有声漫画」这个形态——类似 B 站上已经百万播放验证过的有声漫画视频,对话场景用中景/远景配合微动作,不追求唇形同步,靠字幕和声优表现力撑。

为什么做这个

我是网文读者,注意到很多中腰部的作者其实很想把自己的作品「动漫化」来引流,但找动画工作室动辄几万块一集,完全不现实。AI 视频生成去年下半年的进步让我觉得这个事技术上可行了。

花了两个月调研 + 写 PRD ,技术链路基本跑通了。

我不确定的事

这也是发帖想请教的:

  1. 作者真的需要吗? 我聊过几个作者,反馈两极分化——有人说「太需要了,手动做推文视频累死」,有人说「我不如花钱找人画个封面」。网文作者的付费意愿和能力到底怎么样?
  2. 有声漫画这个定位靠谱吗? 它介于 PPT 推文和真动画之间,会不会两头不讨好?追求动画质感的觉得不够,追求效率的觉得太慢?
  3. 开源免费但依赖商业 API 这个模式怪不怪? 代码全开源,但用户得自己充火山方舟的钱。这种「免费代码 + 付费 API 」的模式,创作者能接受吗?
  4. ¥9-19 一集的成本是高了还是低了? 我个人觉得还行,但网文作者很多是学生/副业,这个价格会不会劝退?
  5. 有没有更痛的场景我没看到? 也许网文作者最大的痛点根本不是「视频化」而是别的什么,我拿着锤子找钉子了?

技术上的诚意

  • 全栈火山方舟(豆包 + Seedream + Seedance + TTS + 视频合成),一个 Key 搞定
  • Web 端提供精调面板:不满意可以手动改角色外观、调整镜头顺序、重绘单帧
  • 角色 IP 库:第一次上传章节后 AI 提取角色设定,作者确认后所有后续章节自动沿用
  • Phase 1 目标:60 分质量,跑通端到端,成本 ¥5-8/集

欢迎泼冷水,也欢迎告诉我「你其实应该做 XXX 方向」。V 站各位的判断力我是信的,拍砖越狠我越清醒。