Ubuntu18.04构建语音识别工具Kaldi并跑通整个TIMIT数据集(包含使用GPU的DNN)

本文主要是介绍Ubuntu18.04构建语音识别工具Kaldi并跑通整个TIMIT数据集(包含使用GPU的DNN),希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

语音识别工具应用最广泛的当属Kaldi了。

文章目录

  • 1. Kaldi简介
  • 2. Ubuntu18.04构建Kaldi
    • 2.1. 准备工作
    • 2.2. 编译Kaldi
    • 2.3. 测试Kaldi
  • 3. 重要更新
  • 4. 再次更新

1. Kaldi简介

  Kaldi是一个语音识别工具,在语音识别研究领域大量使用。以下摘录自博客:

Kaldi是一个C++实现的语音识别工具,它使用Apache v2.0开源协议。它的主要目标用户是语音识别的研究者,它提供现代和灵活的代码,使用C++实现,容易修改和扩展。强调通用算法和recipe;尽量使用能被证明正确的算法;Kaldi的代码都是通过彻底的测试的;尽量避免把简单问题复杂化;Kaldi是容易理解的;Kaldi是容易复用和重构的。目前,Kaldi的代码和脚本实现了大部分标准技术,包括标准的线性变换、MMI、boosted MMI和MCE区分式训练,也包括特征空间的区分性训练。

2. Ubuntu18.04构建Kaldi

2.1. 准备工作

  首先打开终端,从github上克隆Kaldi:git clone https://github.com/kaldi-asr/kaldi.git kaldi --origin upstream,等克隆完成以后,进入tools文件夹:cd tools,然后运行指令:./extras/check_dependencies.sh,该指令检查构建Kaldi所需的依赖项是否安装好。
在这里插入图片描述

图1 检查依赖项

类似于图1,每个人具体的不一样,按照它的建议安装没有安装的依赖项,例如:sudo apt-get install g++ make automake autoconf unzip sox gfortran libtool subversion python2.7。然后再运行./extras/check_dependencies.sh会发现提示没有安装Intel的math kernel library(MKL),可以运行命令extras/install_mkl.sh来安装,但是下载安装很慢,两个多小时。也可以直接去Intel MKL网站下载完整安装包,然后本地解压,进入mkl文件夹运行./install.sh安装。但是这样安装貌似还要自己配置环境变量(我第1次装的时候不用,第2次需要自己配置,索性直接用extras/install_mkl.sh命令,睡一觉起来就装好了)。这个包现在开源的了,去网站下载的话要先注册个账号,然后才能免费下。安装好以后,保险起见,再运行一次./extras/check_dependencies.sh,这次显示:
在这里插入图片描述

图2 依赖项安装完成

  现在依赖项安装完成了,构建Kaldi,tools文件夹里最重要的文件是openfst,这里采取稳妥的方法,去官网下载openfst-1.6.7的压缩包,然后拷贝到tools文件夹下。执行make -j4,4代表cpu的核心数,也可以直接输入make,就是运行慢一点。这里注意,如果事先没有拷贝openfst到tools文件夹下,运行make它也会下载,但是,但是总是出错,试了n次,百度了n次都没有解决。所以,稳妥起见,还是直接下载压缩包,拷贝进去,压缩包我也上传了,免费下载

这篇关于Ubuntu18.04构建语音识别工具Kaldi并跑通整个TIMIT数据集(包含使用GPU的DNN)的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/645493

相关文章

使用Python构建一个Hexo博客发布工具

《使用Python构建一个Hexo博客发布工具》虽然Hexo的命令行工具非常强大,但对于日常的博客撰写和发布过程,我总觉得缺少一个直观的图形界面来简化操作,下面我们就来看看如何使用Python构建一个... 目录引言Hexo博客系统简介设计需求技术选择代码实现主框架界面设计核心功能实现1. 发布文章2. 加

SpringBoot集成Milvus实现数据增删改查功能

《SpringBoot集成Milvus实现数据增删改查功能》milvus支持的语言比较多,支持python,Java,Go,node等开发语言,本文主要介绍如何使用Java语言,采用springboo... 目录1、Milvus基本概念2、添加maven依赖3、配置yml文件4、创建MilvusClient

JS+HTML实现在线图片水印添加工具

《JS+HTML实现在线图片水印添加工具》在社交媒体和内容创作日益频繁的今天,如何保护原创内容、展示品牌身份成了一个不得不面对的问题,本文将实现一个完全基于HTML+CSS构建的现代化图片水印在线工具... 目录概述功能亮点使用方法技术解析延伸思考运行效果项目源码下载总结概述在社交媒体和内容创作日益频繁的

shell编程之函数与数组的使用详解

《shell编程之函数与数组的使用详解》:本文主要介绍shell编程之函数与数组的使用,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录shell函数函数的用法俩个数求和系统资源监控并报警函数函数变量的作用范围函数的参数递归函数shell数组获取数组的长度读取某下的

使用Python开发一个带EPUB转换功能的Markdown编辑器

《使用Python开发一个带EPUB转换功能的Markdown编辑器》Markdown因其简单易用和强大的格式支持,成为了写作者、开发者及内容创作者的首选格式,本文将通过Python开发一个Markd... 目录应用概览代码结构与核心组件1. 初始化与布局 (__init__)2. 工具栏 (setup_t

基于Python打造一个全能文本处理工具

《基于Python打造一个全能文本处理工具》:本文主要介绍一个基于Python+Tkinter开发的全功能本地化文本处理工具,它不仅具备基础的格式转换功能,更集成了中文特色处理等实用功能,有需要的... 目录1. 概述:当文本处理遇上python图形界面2. 功能全景图:六大核心模块解析3.运行效果4. 相

springboot项目中常用的工具类和api详解

《springboot项目中常用的工具类和api详解》在SpringBoot项目中,开发者通常会依赖一些工具类和API来简化开发、提高效率,以下是一些常用的工具类及其典型应用场景,涵盖Spring原生... 目录1. Spring Framework 自带工具类(1) StringUtils(2) Coll

SpringValidation数据校验之约束注解与分组校验方式

《SpringValidation数据校验之约束注解与分组校验方式》本文将深入探讨SpringValidation的核心功能,帮助开发者掌握约束注解的使用技巧和分组校验的高级应用,从而构建更加健壮和可... 目录引言一、Spring Validation基础架构1.1 jsR-380标准与Spring整合1

Python虚拟环境终极(含PyCharm的使用教程)

《Python虚拟环境终极(含PyCharm的使用教程)》:本文主要介绍Python虚拟环境终极(含PyCharm的使用教程),具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,... 目录一、为什么需要虚拟环境?二、虚拟环境创建方式对比三、命令行创建虚拟环境(venv)3.1 基础命令3

Python Transformer 库安装配置及使用方法

《PythonTransformer库安装配置及使用方法》HuggingFaceTransformers是自然语言处理(NLP)领域最流行的开源库之一,支持基于Transformer架构的预训练模... 目录python 中的 Transformer 库及使用方法一、库的概述二、安装与配置三、基础使用:Pi