惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Last Week in AI
Last Week in AI
U
Unit 42
博客园 - 【当耐特】
Y
Y Combinator Blog
H
Hackread – Cybersecurity News, Data Breaches, AI and More
Microsoft Security Blog
Microsoft Security Blog
Recent Announcements
Recent Announcements
P
Proofpoint News Feed
Martin Fowler
Martin Fowler
量子位
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
有赞技术团队
有赞技术团队
aimingoo的专栏
aimingoo的专栏
博客园 - 司徒正美
美团技术团队
雷峰网
雷峰网
小众软件
小众软件
G
Google Developers Blog
GbyAI
GbyAI
Jina AI
Jina AI
爱范儿
爱范儿
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
F
Fortinet All Blogs
Vercel News
Vercel News

博客园 - 虚幻的街景

代码重组输出 合成视频相关节点所需参数格式 windows 10安装thinkPHP6.0 pip 升级 报No module named 'pip'错怎么处理-百度经验 人脸识别之识别出某人并标记 博文阅读密码验证 - 博客园 WIN7环境人脸检测及识别python实现系列(3)——为模型训练准备人脸数据 博文阅读密码验证 - 博客园 安装pillow(python的图形界面库) PIL模块安装 python 用pip安装cv2 python调用摄像头拍照并保存 Python 显示图片和调用摄像头 博文阅读密码验证 - 博客园 博文阅读密码验证 - 博客园 Python3 requests 中文乱码 UnicodeEncodeError: 'latin-1' codec can`t encode characters in …… 博文阅读密码验证 - 博客园 博文阅读密码验证 - 博客园 解决centos7使用yum安装mysql 下载速度慢的问题 博文阅读密码验证 - 博客园
PyAudio 中文手册--静音移除/有声检测
虚幻的街景 · 2020-04-10 · via 博客园 - 虚幻的街景

静音移除/有声检测

audioSegmentation.py中的silenceRemoval()方法将连续的音频拆分为独立的事件片段,即静默的信号都被移除掉了。 其实现主要通过一个半监督方法:首先训练一个SVM模型来分辨(短期时长的)高能信号与低能信号,使用其中10%的高能片段和10%的低能片段来作为训练集。然后对整段音频应用这一SVM训练模型,并使用动态的阈值来判断动态的片段。

核心方法:silenceRemoval(x, fs, st_win, st_step, smoothWindow=0.5, weight=0.5, plot=False)

def silenceRemoval(x, fs, st_win, st_step, smoothWindow=0.5, weight=0.5, plot=False):
    

参数:

x: 输入的音频(数字化的) fs: 采样频率 st_win, st_step: 短期时长的窗口及步长 smoothWindow=0.5: 平滑窗口(单位秒) weight=0.5: 决策阈值(越高越严格) plot=False: 是否可视化结果

返回结果seg_limits是一个数组,表示非静音(有声)片段的起止时间。

根据音频性质的不同,也应该使用不同的平滑窗口和决策阈值。上述的样本中,声音是非常稀疏的。对于持续的讲话,应该使用更短(值更小)的平滑窗口和更严格的(值更大)的决策阈值。

全部手册:https://www.cnblogs.com/liuzhongrong/p/12269181.html