惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

博客园 - 三生石上(FineUI控件)
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
月光博客
月光博客
博客园 - 【当耐特】
Hugging Face - Blog
Hugging Face - Blog
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
爱范儿
爱范儿
大猫的无限游戏
大猫的无限游戏
S
SegmentFault 最新的问题
博客园_首页
雷峰网
雷峰网
量子位
有赞技术团队
有赞技术团队
博客园 - 叶小钗
博客园 - 聂微东
V
V2EX
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
博客园 - 司徒正美
小众软件
小众软件
The Cloudflare Blog
阮一峰的网络日志
阮一峰的网络日志
Apple Machine Learning Research
Apple Machine Learning Research
Jina AI
Jina AI
人人都是产品经理
人人都是产品经理

Wer Blog

离去 - Wer Blog 更优雅的使用CDN - Wer Blog 极验v3滑动拼图验证码逆向与绕过 - Wer Blog 天冷了 我的博客也下雪了 - Wer Blog 2025,在代码与热爱里慢慢生长 - Wer Blog 从豆包手机被封杀到智谱开源掀桌,这些天,我看到了中国AI最精彩的一场攻防战! - Wer Blog TEWA-861G SUPERADMIN权限获取 - Wer Blog Fuwari搭建指北 - Wer Blog 1Panel部署哪吒监控 - Wer Blog 回顾一下2021年9月7日我发的一个朋友圈 - Wer Blog 优化文章排序 - Wer Blog B站主播PK打首胜的最佳攻略 - Wer Blog 锐评B站粉丝勋章亲密度升级公告 - Wer Blog 数学期望:从理论到直播盲盒的现实应用 - Wer Blog 个人博客该何去何从 - Wer Blog Fuwari RSS 图片路径修复指北 - Wer Blog 又迁移了... - Wer Blog QQ机器人:Docker 一键部署 Koishi + NapCat 指北 - Wer Blog 旁路由新思路——“互指架构” - Wer Blog 🚀 使用Netlify反向代理网站的终极指南 🌐 - Wer Blog 一键DD脚本——快速重装纯净系统的终极解决方案 - Wer Blog 🌈 为你的Halo博客注入色彩:邮件美化模板 教程 - Wer Blog Ubuntu SSH暴力破解审查、预防 - Wer Blog (稳定)360t7 openwrt-immortalwrt 自用固件 - Wer Blog 纯净版封装镜像 - Wer Blog 备案技巧 根据访客来源屏蔽管局检查 - Wer Blog Hexo 避坑指南 - Wer Blog
使用RVC克隆自己的声音 - Wer Blog
Yy · 2025-09-07 · via Wer Blog

准备工作#

  1. 硬件要求
    • GPU:推荐使用N卡,显存推荐8G以上。使用GPU训练和推理速度极快。CPU虽然也能用,但速度会非常慢,不适合训练。
    • 内存:至少16G。
    • 硬盘:预留20-30GB可用空间,用于存放模型和音频数据。
  2. 软件
    • 操作系统:Windows。
    • RVC:用于训练模型。
    • UVR:用于分离人声。

训练你自己的声音模型#

  1. 数据准备(数据集)
    • 音源要求: 准备你想要克隆的声音的音频文件(如你自己的声音),要求:
      • 格式.wav(最佳)
      • 质量: 高清、无损最好。人声清晰,没有背景噪音、没有混响、没有音乐。
      • 内容: 如果是说话声音,需要包含多种音调;如果是唱歌,需要包含你的音域。时长10分钟到30分钟的纯净人声即可获得不错的效果。
      • 采样率: 最好是44100Hz。
    • 如何获取干净人声?
      • 自己录制: 使用Audacity等录音软件,在安静的环境下录制。
      • 提取干声: 如果是从已有歌曲中提取,需要使用UVR将人声和背景音乐分离开。

        UVR设置 输出文件

        • Instrumental:背景音乐
        • Vocals:人声
    • 数据处理
      • 将所有准备好的.wav文件放在一个单独的文件夹里,例如./dataset/your_name/
      • 文件名不要有中文或特殊符号
  2. 开始训练: 运行go-web.bat。设置好参数后点击一键训练即可。

    总训练轮数:建议300-500
    训练轮数越多,耗时越长,请自行规划好时间。

使用模型进行声音转换#

切换至模型推理,点击刷新就能看到训练好的模型。

待处理音频文件路径填写需要转换的音频文件路径,同样需要为干净的人声

这一步很快,一首歌的时间大概仅需10秒左右。


希望这份教程能帮助你顺利进入RVC的世界!创作时请务必遵守法律法规,尊重他人的声音版权。