浙工大计算机学院 张晖,计算机(软件)学院师生张晖、郝翔参加语音领域的顶级会议INTERSPEECH 2019...

本文主要是介绍浙工大计算机学院 张晖,计算机(软件)学院师生张晖、郝翔参加语音领域的顶级会议INTERSPEECH 2019...,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

语音领域的顶级学术会议INTERSPEECH于2019年9月15-19日在奥地利第二大城市格拉茨召开,该会议由国际语音通讯协会(International Speech Communication Association)主办,是世界上规模最大、内容最全面的语音会议。今年恰逢INTERSPEECH成功举办20周年,会议以“Crossroads of Speech and Language”为主题,意在探讨语言多样性、应用多样性以及表达方式多样性,吸引了来自世界各地的2000多名学者及企业厂商代表。INTERSPEECH每年召开一次,被CCF(中国计算机学会)列为C类推荐会议。在本次会议上,我校计算机(软件)学院共有两篇论文被录用:

Investigation on cost function for monaural speech separation(刘允,张晖,张学良)

第一作者刘允为2016级研究生(已毕业)。本文探讨了机器学习中的评价指标与代价函数的不一致问题,提出了一种一致性度量方法,并从理论上和实践上证明了提出的方法的有效性,最终以此为基础确定了语音分离任务的最优代价函数。该方法对于消除机器学习中评价指标与代价函数的不一致问题具有普遍意义。

UNetGAN: A Robust Speech Enhancement Approach in Time Domain for Extremely Low Signal-to-noise Ratio Condition(郝翔,苏向东,王治愚,张晖,巴图斯仁)

第一作者郝翔为2018级研究生。本文在非常具有挑战性的极低信噪比下进行语音增强,提出了一种基于U-Net与生成对抗网络的方法,并可以直接在时域上完成映射。该方法极大地提升了极低信噪比下语音的质量与可懂度,甚至在某些特定噪声场景下,可以将原本无法被人听清的语音信号转换为可以被人听清进而能被理解的语音信号。

我校教师张晖与研究生郝翔分别作为两篇论文的代表前往奥地利格拉茨参加了此次会议。

ed8454a1f1556f90e60337d5e925bfbc.png

d3fe698cc370002dc46e4b4b8b986a6c.png

0f05a22dd746b1b2e9a74cb3a7695893.png

上述论文的研究工作得到了国家自然科学基金、内蒙古自治区自然科学基金以及内蒙古大学综合能力提升项目的资助。

这篇关于浙工大计算机学院 张晖,计算机(软件)学院师生张晖、郝翔参加语音领域的顶级会议INTERSPEECH 2019...的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/220915

相关文章

安装centos8设置基础软件仓库时出错的解决方案

《安装centos8设置基础软件仓库时出错的解决方案》:本文主要介绍安装centos8设置基础软件仓库时出错的解决方案,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐... 目录安装Centos8设置基础软件仓库时出错版本 8版本 8.2.200android4版本 javas

如何确定哪些软件是Mac系统自带的? Mac系统内置应用查看技巧

《如何确定哪些软件是Mac系统自带的?Mac系统内置应用查看技巧》如何确定哪些软件是Mac系统自带的?mac系统中有很多自带的应用,想要看看哪些是系统自带,该怎么查看呢?下面我们就来看看Mac系统内... 在MAC电脑上,可以使用以下方法来确定哪些软件是系统自带的:1.应用程序文件夹打开应用程序文件夹

无法启动此程序因为计算机丢失api-ms-win-core-path-l1-1-0.dll修复方案

《无法启动此程序因为计算机丢失api-ms-win-core-path-l1-1-0.dll修复方案》:本文主要介绍了无法启动此程序,详细内容请阅读本文,希望能对你有所帮助... 在计算机使用过程中,我们经常会遇到一些错误提示,其中之一就是"api-ms-win-core-path-l1-1-0.dll丢失

Python中edge-tts实现便捷语音合成

《Python中edge-tts实现便捷语音合成》edge-tts是一个功能强大的Python库,支持多种语言和声音选项,本文主要介绍了Python中edge-tts实现便捷语音合成,具有一定的参考价... 目录安装与环境设置文本转语音查找音色更改语音参数生成音频与字幕总结edge-tts 是一个功能强大的

使用Python实现文本转语音(TTS)并播放音频

《使用Python实现文本转语音(TTS)并播放音频》在开发涉及语音交互或需要语音提示的应用时,文本转语音(TTS)技术是一个非常实用的工具,下面我们来看看如何使用gTTS和playsound库将文本... 目录什么是 gTTS 和 playsound安装依赖库实现步骤 1. 导入库2. 定义文本和语言 3

讯飞webapi语音识别接口调用示例代码(python)

《讯飞webapi语音识别接口调用示例代码(python)》:本文主要介绍如何使用Python3调用讯飞WebAPI语音识别接口,重点解决了在处理语音识别结果时判断是否为最后一帧的问题,通过运行代... 目录前言一、环境二、引入库三、代码实例四、运行结果五、总结前言基于python3 讯飞webAPI语音

如何测试计算机的内存是否存在问题? 判断电脑内存故障的多种方法

《如何测试计算机的内存是否存在问题?判断电脑内存故障的多种方法》内存是电脑中非常重要的组件之一,如果内存出现故障,可能会导致电脑出现各种问题,如蓝屏、死机、程序崩溃等,如何判断内存是否出现故障呢?下... 如果你的电脑是崩溃、冻结还是不稳定,那么它的内存可能有问题。要进行检查,你可以使用Windows 11

Ubuntu 怎么启用 Universe 和 Multiverse 软件源?

《Ubuntu怎么启用Universe和Multiverse软件源?》在Ubuntu中,软件源是用于获取和安装软件的服务器,通过设置和管理软件源,您可以确保系统能够从可靠的来源获取最新的软件... Ubuntu 是一款广受认可且声誉良好的开源操作系统,允许用户通过其庞大的软件包来定制和增强计算体验。这些软件

阿里开源语音识别SenseVoiceWindows环境部署

SenseVoice介绍 SenseVoice 专注于高精度多语言语音识别、情感辨识和音频事件检测多语言识别: 采用超过 40 万小时数据训练,支持超过 50 种语言,识别效果上优于 Whisper 模型。富文本识别:具备优秀的情感识别,能够在测试数据上达到和超过目前最佳情感识别模型的效果。支持声音事件检测能力,支持音乐、掌声、笑声、哭声、咳嗽、喷嚏等多种常见人机交互事件进行检测。高效推

让树莓派智能语音助手实现定时提醒功能

最初的时候是想直接在rasa 的chatbot上实现,因为rasa本身是带有remindschedule模块的。不过经过一番折腾后,忽然发现,chatbot上实现的定时,语音助手不一定会有响应。因为,我目前语音助手的代码设置了长时间无应答会结束对话,这样一来,chatbot定时提醒的触发就不会被语音助手获悉。那怎么让语音助手也具有定时提醒功能呢? 我最后选择的方法是用threading.Time