惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

GbyAI
GbyAI
The GitHub Blog
The GitHub Blog
小众软件
小众软件
美团技术团队
博客园 - 司徒正美
G
Google Developers Blog
Blog — PlanetScale
Blog — PlanetScale
Hugging Face - Blog
Hugging Face - Blog
博客园_首页
大猫的无限游戏
大猫的无限游戏
罗磊的独立博客
Recent Announcements
Recent Announcements
酷 壳 – CoolShell
酷 壳 – CoolShell
D
Docker
J
Java Code Geeks
Last Week in AI
Last Week in AI
V
Visual Studio Blog
Microsoft Azure Blog
Microsoft Azure Blog
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
P
Proofpoint News Feed
V
V2EX
C
Check Point Blog
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
MyScale Blog
MyScale Blog

博客园 - badwood

iptables规则笔记 secueCRT脚本再试牛刀 主机基线脚本 大模型部署手册-英伟达 大模型部署手册-昇腾服务器 ssl自签证书+nginx 备忘 Claude Code私有化使用 mindie推理框架及工程化 minio-2.使用 minio-1.搭建 旧源消失的rpm包安装-devtoolset-9 vllm-ascend 2/2 -双机推理 MCP-1.hello world vllm-ascend 1/2 -单机推理 ESP32-S3玩具1-使用Arduino evalscope使用2-使用自定义数据集压测 设置fdfs自动启动 mindie开启DeepSeek的128K xinference推理embedding等小模型 离线安装docker 昇腾910b服务器初始化 evalscope使用1-基础压测 大模型围栏-nginx+lua 大模型私有化部署-deepseek671-mindie dify-2:问题分类器调整
FunASR
badwood · 2025-11-03 · via 博客园 - badwood

  FunASR是一个框架,里面有多个语音模型。

一、下载并运行funasr镜像。镜像有多个,以GPU版本为例:

docker pull registry.cn-hangzhou.aliyuncs.com/funasr_repo/funasr:funasr-runtime-sdk-gpu-0.2.1
docker run -itd -p 10095:10095 --name=funasr --privileged=true --runtime=nvidia -v /app/models/voice:/workspace/models registry.cn-hangzhou.aliyuncs.com/funasr_repo/funasr:funasr-runtime-sdk-gpu-0.2.1

二、安装需要的组建和模型

# 安装ffmpeg
apt install ffmpeg -y
# 安装python组件
pip install websocket
# 相关语音模型,下面是此次运行所需,模型名称前缀是必须的(damo/等)
damo/punc_ct-transformer_cn-en-common-vocab471067-large-onnx
damo/speech_fsmn_vad_zh-cn-16k-common-onnx
damo/speech_ngram_lm_zh-cn-ai-wesp-fst
damo/speech_paraformer-large-vad-punc_asr_nat-zh-cn-16k-common-vocab8404-pytorch
thuduj12/fst_itn_zh

三、目录

/app/models
└─ voice
   ├─ damo
   │  ├─ punc_ct-transformer_cn-en-common-vocab471067-large-onnx
   │  ├─ speech_fsmn_vad_zh-cn-16k-common-onnx
   │  ├─ speech_ngram_lm_zh-cn-ai-wesp-fst
   │  └─ speech_paraformer-large-vad-punc_asr_nat-zh-cn-16k-common-vocab8404-pytorch
   └─ thuduj12
      └─ fst_itn_zh

四、运行

cd /workspace/FunASR/runtime && nohup bash run_server.sh \
  --download-model-dir /workspace/models \
  --vad-dir damo/speech_fsmn_vad_zh-cn-16k-common-onnx \
  --model-dir damo/speech_paraformer-large-vad-punc_asr_nat-zh-cn-16k-common-vocab8404-pytorch  \
  --punc-dir damo/punc_ct-transformer_cn-en-common-vocab471067-large-onnx \
  --lm-dir damo/speech_ngram_lm_zh-cn-ai-wesp-fst \
  --itn-dir thuduj12/fst_itn_zh \
  --hotword /workspace/models/hotwords.txt > log.txt 2>&1 &

五、验证

python runtime/python/websocket/funasr_wss_client.py --host "192.168.145.11" --port 10095 --ssl 0 --mode 2pass --audio_in "runtime/funasr_apiasr_example.wav" --output_dir "./results"

六、注意

  如果没有在workspace/models/目录下放置对应模型,在运行run_server.sh脚本后会自动去下载,内网服务器要在运行脚本前开启代理。

七、链接

《使用Docker部署FunASR服务》