惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

P
Privacy & Cybersecurity Law Blog
人人都是产品经理
人人都是产品经理
The Cloudflare Blog
B
Blog RSS Feed
罗磊的独立博客
V
V2EX
V
Visual Studio Blog
博客园 - 叶小钗
W
WeLiveSecurity
小众软件
小众软件
K
Kaspersky official blog
美团技术团队
雷峰网
雷峰网
阮一峰的网络日志
阮一峰的网络日志
Martin Fowler
Martin Fowler
Recorded Future
Recorded Future
Project Zero
Project Zero
Hugging Face - Blog
Hugging Face - Blog
Engineering at Meta
Engineering at Meta
Security Latest
Security Latest
Microsoft Azure Blog
Microsoft Azure Blog
V
Vulnerabilities – Threatpost
月光博客
月光博客
博客园 - 三生石上(FineUI控件)
Help Net Security
Help Net Security
博客园 - Franky
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
F
Fortinet All Blogs
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
Forbes - Security
Forbes - Security
M
MIT News - Artificial intelligence
H
Hacker News: Front Page
大猫的无限游戏
大猫的无限游戏
Vercel News
Vercel News
Spread Privacy
Spread Privacy
The Register - Security
The Register - Security
H
Hackread – Cybersecurity News, Data Breaches, AI and More
量子位
Google Online Security Blog
Google Online Security Blog
PCI Perspectives
PCI Perspectives
The Last Watchdog
The Last Watchdog
AI
AI
N
News | PayPal Newsroom
D
DataBreaches.Net
Cloudbric
Cloudbric
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
博客园 - 司徒正美
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
T
Tailwind CSS Blog

峰峰的小窝

从零开始的自动驾驶(六)无刷电调硬件改了又改 从零开始的自动驾驶(五)整体设计|峰峰的小窝 从零开始的自动驾驶(四)无刷电调硬件修改|峰峰的小窝 从零开始的自动驾驶(三)ROS2与雷达|峰峰的小窝 从零开始的自动驾驶(二)编译开发板Linux|峰峰的小窝 从零开始的自动驾驶(一)无刷电调硬件|峰峰的小窝 搭建代理服务器跳板|峰峰的小窝 迎接新的时代|峰峰的小窝 一段故事的结束|峰峰的小窝 AI全自动写小说|峰峰的小窝 桌面直播通话APP设计实现|峰峰的小窝 2025 年总结|峰峰的小窝 SPI串并转换模块|峰峰的小窝 一种另类的数据标注方法|峰峰的小窝 GPS定位模块设计|峰峰的小窝 STM32硬件和软件设计指南|峰峰的小窝 基于Docker的多实例管理系统|峰峰的小窝 Hello PCB|峰峰的小窝 Hello ESP8266|峰峰的小窝 实时语音智能体快速搭建|峰峰的小窝 Git自动化测试部署|峰峰的小窝 Docker镜像构建和部署|峰峰的小窝 Web应用私有化|峰峰的小窝 虚幻FFMPEG解码视频|峰峰的小窝 阶段总结|峰峰的小窝
Fish-Speech的编译优化|峰峰的小窝
FFeng 我能想到的,最大的成功就是无愧于自己的心。 · 2025-02-24 · via 峰峰的小窝

我们都知道,Python的执行效率很低。

在我的一个数字人项目中,需要用到Fish-Speech,但据测试,在不进行预编译的情况下,RTX4080上Fish-Speech甚至每2秒生成1秒音频,这无法满足实时性要求。

我们使用编译优化来解决问题啦——

Tips:本文仅针对于Windows,Linux酌情阅读,本文写时Fish Speech的Releases版本是v1.4.3,时间久了本文信息会存在时效性问题。

编译环境

使用Pytorch的编译优化需要事先安装C/C++编译环境。

Fish-Speech官方文档中介绍了编译加速需要的环境,这些环境不仅是Fish-Speech,其他东西的编译优化也需要。

所以请实现安装好哦~

需要做的的内容如下:

  • 安装LLVM

  • 将LLVM加入到PATH(LLVM安装程序可以自动完成这一步)

  • 安装Visual Studio。

  • 安装Visual Studio 的 C++桌面开发。

然后,检查系统以前是否配置过 CCCXX 环境变量,删掉,配置这些会导致之后编译失败。

根据Fish-Speech官方文档安装好了编译环境,并且使用了官方的Python环境,理论上是能够直接编译优化启动的。

但这里我因为需要集成仅项目,并没有使用Fish-Speech的Python环境,使用了自己的环境,在踩了各种各样的坑之后,得出以下结论:

  • 为了不出莫名其妙的问题,Triton(往GPU上编译优化用的)最好使用官方的预编译版本。

  • 使用官方预编译Triton,Python版本需要是3.10.16,否则会报无法导入DLL。

  • 使用官方预编译Triton,Pytorch版本最好是2.4.1+cu121,否则据测试会报莫名其妙的编译错误。

据测试,编译优化后,6秒生成了52秒音频,速度提升相当显著。