Ubuntu18.04构建语音识别工具Kaldi并跑通整个TIMIT数据集(包含使用GPU的DNN)

本文主要是介绍Ubuntu18.04构建语音识别工具Kaldi并跑通整个TIMIT数据集(包含使用GPU的DNN),希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

语音识别工具应用最广泛的当属Kaldi了。

文章目录

  • 1. Kaldi简介
  • 2. Ubuntu18.04构建Kaldi
    • 2.1. 准备工作
    • 2.2. 编译Kaldi
    • 2.3. 测试Kaldi
  • 3. 重要更新
  • 4. 再次更新

1. Kaldi简介

  Kaldi是一个语音识别工具,在语音识别研究领域大量使用。以下摘录自博客:

Kaldi是一个C++实现的语音识别工具,它使用Apache v2.0开源协议。它的主要目标用户是语音识别的研究者,它提供现代和灵活的代码,使用C++实现,容易修改和扩展。强调通用算法和recipe;尽量使用能被证明正确的算法;Kaldi的代码都是通过彻底的测试的;尽量避免把简单问题复杂化;Kaldi是容易理解的;Kaldi是容易复用和重构的。目前,Kaldi的代码和脚本实现了大部分标准技术,包括标准的线性变换、MMI、boosted MMI和MCE区分式训练,也包括特征空间的区分性训练。

2. Ubuntu18.04构建Kaldi

2.1. 准备工作

  首先打开终端,从github上克隆Kaldi:git clone https://github.com/kaldi-asr/kaldi.git kaldi --origin upstream,等克隆完成以后,进入tools文件夹:cd tools,然后运行指令:./extras/check_dependencies.sh,该指令检查构建Kaldi所需的依赖项是否安装好。
在这里插入图片描述

图1 检查依赖项

类似于图1,每个人具体的不一样,按照它的建议安装没有安装的依赖项,例如:sudo apt-get install g++ make automake autoconf unzip sox gfortran libtool subversion python2.7。然后再运行./extras/check_dependencies.sh会发现提示没有安装Intel的math kernel library(MKL),可以运行命令extras/install_mkl.sh来安装,但是下载安装很慢,两个多小时。也可以直接去Intel MKL网站下载完整安装包,然后本地解压,进入mkl文件夹运行./install.sh安装。但是这样安装貌似还要自己配置环境变量(我第1次装的时候不用,第2次需要自己配置,索性直接用extras/install_mkl.sh命令,睡一觉起来就装好了)。这个包现在开源的了,去网站下载的话要先注册个账号,然后才能免费下。安装好以后,保险起见,再运行一次./extras/check_dependencies.sh,这次显示:
在这里插入图片描述

图2 依赖项安装完成

  现在依赖项安装完成了,构建Kaldi,tools文件夹里最重要的文件是openfst,这里采取稳妥的方法,去官网下载openfst-1.6.7的压缩包,然后拷贝到tools文件夹下。执行make -j4,4代表cpu的核心数,也可以直接输入make,就是运行慢一点。这里注意,如果事先没有拷贝openfst到tools文件夹下,运行make它也会下载,但是,但是总是出错,试了n次,百度了n次都没有解决。所以,稳妥起见,还是直接下载压缩包,拷贝进去,压缩包我也上传了,免费下载

这篇关于Ubuntu18.04构建语音识别工具Kaldi并跑通整个TIMIT数据集(包含使用GPU的DNN)的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/645493

相关文章

使用Navicat工具比对两个数据库所有表结构的差异案例详解

《使用Navicat工具比对两个数据库所有表结构的差异案例详解》:本文主要介绍如何使用Navicat工具对比两个数据库test_old和test_new,并生成相应的DDLSQL语句,以便将te... 目录概要案例一、如图两个数据库test_old和test_new进行比较:二、开始比较总结概要公司存在多

Redis的数据过期策略和数据淘汰策略

《Redis的数据过期策略和数据淘汰策略》本文主要介绍了Redis的数据过期策略和数据淘汰策略,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一... 目录一、数据过期策略1、惰性删除2、定期删除二、数据淘汰策略1、数据淘汰策略概念2、8种数据淘汰策略

轻松上手MYSQL之JSON函数实现高效数据查询与操作

《轻松上手MYSQL之JSON函数实现高效数据查询与操作》:本文主要介绍轻松上手MYSQL之JSON函数实现高效数据查询与操作的相关资料,MySQL提供了多个JSON函数,用于处理和查询JSON数... 目录一、jsON_EXTRACT 提取指定数据二、JSON_UNQUOTE 取消双引号三、JSON_KE

CSS3中使用flex和grid实现等高元素布局的示例代码

《CSS3中使用flex和grid实现等高元素布局的示例代码》:本文主要介绍了使用CSS3中的Flexbox和Grid布局实现等高元素布局的方法,通过简单的两列实现、每行放置3列以及全部代码的展示,展示了这两种布局方式的实现细节和效果,详细内容请阅读本文,希望能对你有所帮助... 过往的实现方法是使用浮动加

如何使用Spring boot的@Transactional进行事务管理

《如何使用Springboot的@Transactional进行事务管理》这篇文章介绍了SpringBoot中使用@Transactional注解进行声明式事务管理的详细信息,包括基本用法、核心配置... 目录一、前置条件二、基本用法1. 在方法上添加注解2. 在类上添加注解三、核心配置参数1. 传播行为(

在Java中使用ModelMapper简化Shapefile属性转JavaBean实战过程

《在Java中使用ModelMapper简化Shapefile属性转JavaBean实战过程》本文介绍了在Java中使用ModelMapper库简化Shapefile属性转JavaBean的过程,对比... 目录前言一、原始的处理办法1、使用Set方法来转换2、使用构造方法转换二、基于ModelMapper

c++中std::placeholders的使用方法

《c++中std::placeholders的使用方法》std::placeholders是C++标准库中的一个工具,用于在函数对象绑定时创建占位符,本文就来详细的介绍一下,具有一定的参考价值,感兴... 目录1. 基本概念2. 使用场景3. 示例示例 1:部分参数绑定示例 2:参数重排序4. 注意事项5.

使用C++将处理后的信号保存为PNG和TIFF格式

《使用C++将处理后的信号保存为PNG和TIFF格式》在信号处理领域,我们常常需要将处理结果以图像的形式保存下来,方便后续分析和展示,C++提供了多种库来处理图像数据,本文将介绍如何使用stb_ima... 目录1. PNG格式保存使用stb_imagephp_write库1.1 安装和包含库1.2 代码解

一文教你使用Python实现本地分页

《一文教你使用Python实现本地分页》这篇文章主要为大家详细介绍了Python如何实现本地分页的算法,主要针对二级数据结构,文中的示例代码简洁易懂,有需要的小伙伴可以了解下... 在项目开发的过程中,遇到分页的第一页就展示大量的数据,导致前端列表加载展示的速度慢,所以需要在本地加入分页处理,把所有数据先放

Python给Excel写入数据的四种方法小结

《Python给Excel写入数据的四种方法小结》本文主要介绍了Python给Excel写入数据的四种方法小结,包含openpyxl库、xlsxwriter库、pandas库和win32com库,具有... 目录1. 使用 openpyxl 库2. 使用 xlsxwriter 库3. 使用 pandas 库