【端点检测】短时能量和过零率双门限语音端点检测附matlab代码

2023-10-17 21:40

本文主要是介绍【端点检测】短时能量和过零率双门限语音端点检测附matlab代码,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

✅作者简介:热爱科研的Matlab仿真开发者,修心和技术同步精进,matlab项目合作可私信。

🍎个人主页:Matlab科研工作室

🍊个人信条:格物致知。

更多Matlab仿真内容点击👇

智能优化算法       神经网络预测       雷达通信       无线传感器        电力系统

信号处理              图像处理               路径规划       元胞自动机        无人机 

⛄ 内容介绍

短时能量和过零率双门限语音端点检测是一种常见的语音处理方法,用于检测语音信号中的起始点和终止点。下面是基于短时能量和过零率的双门限语音端点检测的基本原理:

  1. 分帧:将输入的连续语音信号划分为一系列重叠的短时帧。每个帧通常持续几十毫秒至几百毫秒。

  2. 计算短时能量:对于每个帧,计算该帧内采样点的平方和,即短时能量。可以通过对每个采样点进行平方,并对得到的结果求和来计算短时能量。

  3. 计算短时过零率:对于每个帧,计算过零率,即负波形交叉的次数。过零率越高,表示波形变化越频繁。

  4. 设置能量和过零率阈值:根据实际需求,设置能量阈值和过零率阈值。这些阈值可根据数据集的特征进行调整。

  5. 端点检测:从第一个帧开始扫描每个帧,当满足以下条件时被视为语音段的起始点:

    类似地,反向扫描,当满足以下条件时被视为语音段的终止点:

    • 当前帧的能量超过能量阈值;

    • 后一帧的能量未超过能量阈值;

    • 当前帧的过零率超过过零率阈值。

    • 当前帧的能量超过能量阈未超过能量阈值;

    • 当前帧的过零率超过过零率阈值。

  6. 得到语音段:根据检测到的起始点和终止点,将对应的语音段提取出来作为最终的语音结果。

需要注意的是,能量和过零率的阈值设置会直接影响端点检测的准确性和灵敏度。若设定过高的阈值,则可能导致端点漏检;若设定过低的阈,则可能会产生误检。因此,在实际应用中,需要根据具体数据集和应用场景进行合适的参数调整。

⛄ 部分代码

function f=enframe(x,win,inc)%定义函数。

nx=length(x(:)); %x(:)的作用是把x给弄成一个向量,x为一行,则变成一列,如果为矩阵,则按每一列的顺序排成一列。得出的nx为序列的数据个数。

nwin=length(win);

if (nwin == 1)

    len = win; %如果win中就一个数,则len就=该数,此例中为256个点。即每帧长

else

    len = nwin; %如果有多个数,则len=个数。

end

if (nargin < 3) % nargin返回的是函数输入的个数,如果中间有变量,返回的是负值。

    inc = len; %也就是说,如果函数enframe的输入只有两个的话,系统就自动赋inc

end

nf = fix((nx-len+inc)/inc);%这个比较关键,nf为分帧的组数,结合下边的可以分析这里

                                    %各参数的意义,len为帧长,inc为未覆盖的数据,nx为整个数

                    % 据量。假设数据为1:30,len为10,未覆盖为5,则nf=5,5

                   %  组,第一组为1,2,……10,第二组为6,7,……15,依次列

%推,便可知其缘由,即(nx-len )/inc + 1;

f=zeros(nf,len);             %构成以组数为行,帧长为列的矩阵。

indf= inc*(0:(nf-1)).'; %indf为一列nf个数据,即0到nf-1的inc倍,即分好了每幀起点。

inds = (1:len);      %构成了长度为len的一行。

f(:) = x(indf(:,ones(1,len))+inds(ones(nf,1),:));

                            %上一条语句为整个算法的核心部分了,indf(:,ones(1,len))把indf的

                        % 第一列扩展了nf*len的矩阵。同理inds(ones(nf,1),:)把inds第一行扩

%展为nf*len的矩阵,相加得到

%inc+1 inc+2 inc+3 …… inc+len

%2*inc+1………… ……2*inc+len

%…………………………………]然后就按照这个矩阵从x中把数据给选出来,达到分帧的目的。

if (nwin > 1)    %nwin大于1的情况就不说了。

w = win(:)';

f = f .* w(ones(nf,1),:);

end

⛄ 运行结果

⛄ 参考文献

[1] 韦向峰,袁毅,张全,等.基于端点检测的蒙藏维语音片段数据集[J].中国科学数据:中英文网络版, 2019, 4(4):11.DOI:10.11922/csdata.2019.0024.zh.

[2] 刘波,聂明新,向俊涛.基于短时能量和过零率分析的语音端点检测方法研究[J].  2007.

[3] 卓嘎,边巴旺堆,姜军.基于短时平均能量和短时过零率的藏语语音端点检测研究[J].电脑知识与技术:学术版, 2014(11):4.DOI:CNKI:SUN:DNZS.0.2014-31-082.

⛳️ 代码获取关注我

❤️部分理论引用网络文献,若有侵权联系博主删除
❤️ 关注我领取海量matlab电子书和数学建模资料

🍅 仿真咨询

1.卷积神经网络(CNN)、LSTM、支持向量机(SVM)、最小二乘支持向量机(LSSVM)、极限学习机(ELM)、核极限学习机(KELM)、BP、RBF、宽度学习、DBN、RF、RBF、DELM实现风电预测、光伏预测、电池寿命预测、辐射源识别、交通流预测、负荷预测、股价预测、PM2.5浓度预测、电池健康状态预测、水体光学参数反演、NLOS信号识别、地铁停车精准预测、变压器故障诊断
2.图像识别、图像分割、图像检测、图像隐藏、图像配准、图像拼接、图像融合、图像增强、图像压缩感知
3.旅行商问题(TSP)、车辆路径问题(VRP、MVRP、CVRP、VRPTW等)、无人机三维路径规划、无人机协同、无人机编队、机器人路径规划、栅格地图路径规划、多式联运运输问题、车辆协同无人机路径规划
4.无人机路径规划、无人机控制、无人机编队、无人机协同、无人机任务分配
5.传感器部署优化、通信协议优化、路由优化、目标定位
6.信号识别、信号加密、信号去噪、信号增强、雷达信号处理、信号水印嵌入提取、肌电信号、脑电信号
7.生产调度、经济调度、装配线调度、充电优化、车间调度、发车优化、水库调度、三维装箱、物流选址、货位优化
8.微电网优化、无功优化、配电网重构、储能配置
9.元胞自动机交通流 人群疏散 病毒扩散 晶体生长

 

这篇关于【端点检测】短时能量和过零率双门限语音端点检测附matlab代码的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/228109

相关文章

Django开发时如何避免频繁发送短信验证码(python图文代码)

《Django开发时如何避免频繁发送短信验证码(python图文代码)》Django开发时,为防止频繁发送验证码,后端需用Redis限制请求频率,结合管道技术提升效率,通过生产者消费者模式解耦业务逻辑... 目录避免频繁发送 验证码1. www.chinasem.cn避免频繁发送 验证码逻辑分析2. 避免频繁

精选20个好玩又实用的的Python实战项目(有图文代码)

《精选20个好玩又实用的的Python实战项目(有图文代码)》文章介绍了20个实用Python项目,涵盖游戏开发、工具应用、图像处理、机器学习等,使用Tkinter、PIL、OpenCV、Kivy等库... 目录① 猜字游戏② 闹钟③ 骰子模拟器④ 二维码⑤ 语言检测⑥ 加密和解密⑦ URL缩短⑧ 音乐播放

Python使用Tenacity一行代码实现自动重试详解

《Python使用Tenacity一行代码实现自动重试详解》tenacity是一个专为Python设计的通用重试库,它的核心理念就是用简单、清晰的方式,为任何可能失败的操作添加重试能力,下面我们就来看... 目录一切始于一个简单的 API 调用Tenacity 入门:一行代码实现优雅重试精细控制:让重试按我

Python实现MQTT通信的示例代码

《Python实现MQTT通信的示例代码》本文主要介绍了Python实现MQTT通信的示例代码,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一... 目录1. 安装paho-mqtt库‌2. 搭建MQTT代理服务器(Broker)‌‌3. pytho

MySQL进行数据库审计的详细步骤和示例代码

《MySQL进行数据库审计的详细步骤和示例代码》数据库审计通过触发器、内置功能及第三方工具记录和监控数据库活动,确保安全、完整与合规,Java代码实现自动化日志记录,整合分析系统提升监控效率,本文给大... 目录一、数据库审计的基本概念二、使用触发器进行数据库审计1. 创建审计表2. 创建触发器三、Java

Linux系统性能检测命令详解

《Linux系统性能检测命令详解》本文介绍了Linux系统常用的监控命令(如top、vmstat、iostat、htop等)及其参数功能,涵盖进程状态、内存使用、磁盘I/O、系统负载等多维度资源监控,... 目录toppsuptimevmstatIOStatiotopslabtophtopdstatnmon

Java中调用数据库存储过程的示例代码

《Java中调用数据库存储过程的示例代码》本文介绍Java通过JDBC调用数据库存储过程的方法,涵盖参数类型、执行步骤及数据库差异,需注意异常处理与资源管理,以优化性能并实现复杂业务逻辑,感兴趣的朋友... 目录一、存储过程概述二、Java调用存储过程的基本javascript步骤三、Java调用存储过程示

Visual Studio 2022 编译C++20代码的图文步骤

《VisualStudio2022编译C++20代码的图文步骤》在VisualStudio中启用C++20import功能,需设置语言标准为ISOC++20,开启扫描源查找模块依赖及实验性标... 默认创建Visual Studio桌面控制台项目代码包含C++20的import方法。右键项目的属性:

MySQL数据库的内嵌函数和联合查询实例代码

《MySQL数据库的内嵌函数和联合查询实例代码》联合查询是一种将多个查询结果组合在一起的方法,通常使用UNION、UNIONALL、INTERSECT和EXCEPT关键字,下面:本文主要介绍MyS... 目录一.数据库的内嵌函数1.1聚合函数COUNT([DISTINCT] expr)SUM([DISTIN

Java实现自定义table宽高的示例代码

《Java实现自定义table宽高的示例代码》在桌面应用、管理系统乃至报表工具中,表格(JTable)作为最常用的数据展示组件,不仅承载对数据的增删改查,还需要配合布局与视觉需求,而JavaSwing... 目录一、项目背景详细介绍二、项目需求详细介绍三、相关技术详细介绍四、实现思路详细介绍五、完整实现代码