Ubuntu18.04构建语音识别工具Kaldi并跑通整个TIMIT数据集(包含使用GPU的DNN)

本文主要是介绍Ubuntu18.04构建语音识别工具Kaldi并跑通整个TIMIT数据集(包含使用GPU的DNN),希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

语音识别工具应用最广泛的当属Kaldi了。

文章目录

  • 1. Kaldi简介
  • 2. Ubuntu18.04构建Kaldi
    • 2.1. 准备工作
    • 2.2. 编译Kaldi
    • 2.3. 测试Kaldi
  • 3. 重要更新
  • 4. 再次更新

1. Kaldi简介

  Kaldi是一个语音识别工具,在语音识别研究领域大量使用。以下摘录自博客:

Kaldi是一个C++实现的语音识别工具,它使用Apache v2.0开源协议。它的主要目标用户是语音识别的研究者,它提供现代和灵活的代码,使用C++实现,容易修改和扩展。强调通用算法和recipe;尽量使用能被证明正确的算法;Kaldi的代码都是通过彻底的测试的;尽量避免把简单问题复杂化;Kaldi是容易理解的;Kaldi是容易复用和重构的。目前,Kaldi的代码和脚本实现了大部分标准技术,包括标准的线性变换、MMI、boosted MMI和MCE区分式训练,也包括特征空间的区分性训练。

2. Ubuntu18.04构建Kaldi

2.1. 准备工作

  首先打开终端,从github上克隆Kaldi:git clone https://github.com/kaldi-asr/kaldi.git kaldi --origin upstream,等克隆完成以后,进入tools文件夹:cd tools,然后运行指令:./extras/check_dependencies.sh,该指令检查构建Kaldi所需的依赖项是否安装好。
在这里插入图片描述

图1 检查依赖项

类似于图1,每个人具体的不一样,按照它的建议安装没有安装的依赖项,例如:sudo apt-get install g++ make automake autoconf unzip sox gfortran libtool subversion python2.7。然后再运行./extras/check_dependencies.sh会发现提示没有安装Intel的math kernel library(MKL),可以运行命令extras/install_mkl.sh来安装,但是下载安装很慢,两个多小时。也可以直接去Intel MKL网站下载完整安装包,然后本地解压,进入mkl文件夹运行./install.sh安装。但是这样安装貌似还要自己配置环境变量(我第1次装的时候不用,第2次需要自己配置,索性直接用extras/install_mkl.sh命令,睡一觉起来就装好了)。这个包现在开源的了,去网站下载的话要先注册个账号,然后才能免费下。安装好以后,保险起见,再运行一次./extras/check_dependencies.sh,这次显示:
在这里插入图片描述

图2 依赖项安装完成

  现在依赖项安装完成了,构建Kaldi,tools文件夹里最重要的文件是openfst,这里采取稳妥的方法,去官网下载openfst-1.6.7的压缩包,然后拷贝到tools文件夹下。执行make -j4,4代表cpu的核心数,也可以直接输入make,就是运行慢一点。这里注意,如果事先没有拷贝openfst到tools文件夹下,运行make它也会下载,但是,但是总是出错,试了n次,百度了n次都没有解决。所以,稳妥起见,还是直接下载压缩包,拷贝进去,压缩包我也上传了,免费下载

这篇关于Ubuntu18.04构建语音识别工具Kaldi并跑通整个TIMIT数据集(包含使用GPU的DNN)的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/645493

相关文章

Java使用jar命令配置服务器端口的完整指南

《Java使用jar命令配置服务器端口的完整指南》本文将详细介绍如何使用java-jar命令启动应用,并重点讲解如何配置服务器端口,同时提供一个实用的Web工具来简化这一过程,希望对大家有所帮助... 目录1. Java Jar文件简介1.1 什么是Jar文件1.2 创建可执行Jar文件2. 使用java

C#使用Spire.Doc for .NET实现HTML转Word的高效方案

《C#使用Spire.Docfor.NET实现HTML转Word的高效方案》在Web开发中,HTML内容的生成与处理是高频需求,然而,当用户需要将HTML页面或动态生成的HTML字符串转换为Wor... 目录引言一、html转Word的典型场景与挑战二、用 Spire.Doc 实现 HTML 转 Word1

Java中的抽象类与abstract 关键字使用详解

《Java中的抽象类与abstract关键字使用详解》:本文主要介绍Java中的抽象类与abstract关键字使用详解,本文通过实例代码给大家介绍的非常详细,感兴趣的朋友跟随小编一起看看吧... 目录一、抽象类的概念二、使用 abstract2.1 修饰类 => 抽象类2.2 修饰方法 => 抽象方法,没有

MyBatis ParameterHandler的具体使用

《MyBatisParameterHandler的具体使用》本文主要介绍了MyBatisParameterHandler的具体使用,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参... 目录一、概述二、源码1 关键属性2.setParameters3.TypeHandler1.TypeHa

Spring 中的切面与事务结合使用完整示例

《Spring中的切面与事务结合使用完整示例》本文给大家介绍Spring中的切面与事务结合使用完整示例,本文通过实例代码给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的朋友参考... 目录 一、前置知识:Spring AOP 与 事务的关系 事务本质上就是一个“切面”二、核心组件三、完

使用docker搭建嵌入式Linux开发环境

《使用docker搭建嵌入式Linux开发环境》本文主要介绍了使用docker搭建嵌入式Linux开发环境,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面... 目录1、前言2、安装docker3、编写容器管理脚本4、创建容器1、前言在日常开发全志、rk等不同

使用Python实现Word文档的自动化对比方案

《使用Python实现Word文档的自动化对比方案》我们经常需要比较两个Word文档的版本差异,无论是合同修订、论文修改还是代码文档更新,人工比对不仅效率低下,还容易遗漏关键改动,下面通过一个实际案例... 目录引言一、使用python-docx库解析文档结构二、使用difflib进行差异比对三、高级对比方

MyBatis-plus处理存储json数据过程

《MyBatis-plus处理存储json数据过程》文章介绍MyBatis-Plus3.4.21处理对象与集合的差异:对象可用内置Handler配合autoResultMap,集合需自定义处理器继承F... 目录1、如果是对象2、如果需要转换的是List集合总结对象和集合分两种情况处理,目前我用的MP的版本

Three.js构建一个 3D 商品展示空间完整实战项目

《Three.js构建一个3D商品展示空间完整实战项目》Three.js是一个强大的JavaScript库,专用于在Web浏览器中创建3D图形,:本文主要介绍Three.js构建一个3D商品展... 目录引言项目核心技术1. 项目架构与资源组织2. 多模型切换、交互热点绑定3. 移动端适配与帧率优化4. 可

sky-take-out项目中Redis的使用示例详解

《sky-take-out项目中Redis的使用示例详解》SpringCache是Spring的缓存抽象层,通过注解简化缓存管理,支持Redis等提供者,适用于方法结果缓存、更新和删除操作,但无法实现... 目录Spring Cache主要特性核心注解1.@Cacheable2.@CachePut3.@Ca