浙工大计算机学院 张晖,计算机(软件)学院师生张晖、郝翔参加语音领域的顶级会议INTERSPEECH 2019...

本文主要是介绍浙工大计算机学院 张晖,计算机(软件)学院师生张晖、郝翔参加语音领域的顶级会议INTERSPEECH 2019...,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

语音领域的顶级学术会议INTERSPEECH于2019年9月15-19日在奥地利第二大城市格拉茨召开,该会议由国际语音通讯协会(International Speech Communication Association)主办,是世界上规模最大、内容最全面的语音会议。今年恰逢INTERSPEECH成功举办20周年,会议以“Crossroads of Speech and Language”为主题,意在探讨语言多样性、应用多样性以及表达方式多样性,吸引了来自世界各地的2000多名学者及企业厂商代表。INTERSPEECH每年召开一次,被CCF(中国计算机学会)列为C类推荐会议。在本次会议上,我校计算机(软件)学院共有两篇论文被录用:

Investigation on cost function for monaural speech separation(刘允,张晖,张学良)

第一作者刘允为2016级研究生(已毕业)。本文探讨了机器学习中的评价指标与代价函数的不一致问题,提出了一种一致性度量方法,并从理论上和实践上证明了提出的方法的有效性,最终以此为基础确定了语音分离任务的最优代价函数。该方法对于消除机器学习中评价指标与代价函数的不一致问题具有普遍意义。

UNetGAN: A Robust Speech Enhancement Approach in Time Domain for Extremely Low Signal-to-noise Ratio Condition(郝翔,苏向东,王治愚,张晖,巴图斯仁)

第一作者郝翔为2018级研究生。本文在非常具有挑战性的极低信噪比下进行语音增强,提出了一种基于U-Net与生成对抗网络的方法,并可以直接在时域上完成映射。该方法极大地提升了极低信噪比下语音的质量与可懂度,甚至在某些特定噪声场景下,可以将原本无法被人听清的语音信号转换为可以被人听清进而能被理解的语音信号。

我校教师张晖与研究生郝翔分别作为两篇论文的代表前往奥地利格拉茨参加了此次会议。

ed8454a1f1556f90e60337d5e925bfbc.png

d3fe698cc370002dc46e4b4b8b986a6c.png

0f05a22dd746b1b2e9a74cb3a7695893.png

上述论文的研究工作得到了国家自然科学基金、内蒙古自治区自然科学基金以及内蒙古大学综合能力提升项目的资助。

这篇关于浙工大计算机学院 张晖,计算机(软件)学院师生张晖、郝翔参加语音领域的顶级会议INTERSPEECH 2019...的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/220915

相关文章

使用Python实现文本转语音(TTS)并播放音频

《使用Python实现文本转语音(TTS)并播放音频》在开发涉及语音交互或需要语音提示的应用时,文本转语音(TTS)技术是一个非常实用的工具,下面我们来看看如何使用gTTS和playsound库将文本... 目录什么是 gTTS 和 playsound安装依赖库实现步骤 1. 导入库2. 定义文本和语言 3

讯飞webapi语音识别接口调用示例代码(python)

《讯飞webapi语音识别接口调用示例代码(python)》:本文主要介绍如何使用Python3调用讯飞WebAPI语音识别接口,重点解决了在处理语音识别结果时判断是否为最后一帧的问题,通过运行代... 目录前言一、环境二、引入库三、代码实例四、运行结果五、总结前言基于python3 讯飞webAPI语音

如何测试计算机的内存是否存在问题? 判断电脑内存故障的多种方法

《如何测试计算机的内存是否存在问题?判断电脑内存故障的多种方法》内存是电脑中非常重要的组件之一,如果内存出现故障,可能会导致电脑出现各种问题,如蓝屏、死机、程序崩溃等,如何判断内存是否出现故障呢?下... 如果你的电脑是崩溃、冻结还是不稳定,那么它的内存可能有问题。要进行检查,你可以使用Windows 11

Ubuntu 怎么启用 Universe 和 Multiverse 软件源?

《Ubuntu怎么启用Universe和Multiverse软件源?》在Ubuntu中,软件源是用于获取和安装软件的服务器,通过设置和管理软件源,您可以确保系统能够从可靠的来源获取最新的软件... Ubuntu 是一款广受认可且声誉良好的开源操作系统,允许用户通过其庞大的软件包来定制和增强计算体验。这些软件

阿里开源语音识别SenseVoiceWindows环境部署

SenseVoice介绍 SenseVoice 专注于高精度多语言语音识别、情感辨识和音频事件检测多语言识别: 采用超过 40 万小时数据训练,支持超过 50 种语言,识别效果上优于 Whisper 模型。富文本识别:具备优秀的情感识别,能够在测试数据上达到和超过目前最佳情感识别模型的效果。支持声音事件检测能力,支持音乐、掌声、笑声、哭声、咳嗽、喷嚏等多种常见人机交互事件进行检测。高效推

让树莓派智能语音助手实现定时提醒功能

最初的时候是想直接在rasa 的chatbot上实现,因为rasa本身是带有remindschedule模块的。不过经过一番折腾后,忽然发现,chatbot上实现的定时,语音助手不一定会有响应。因为,我目前语音助手的代码设置了长时间无应答会结束对话,这样一来,chatbot定时提醒的触发就不会被语音助手获悉。那怎么让语音助手也具有定时提醒功能呢? 我最后选择的方法是用threading.Time

软件设计师备考——计算机系统

学习内容源自「软件设计师」 上午题 #1 计算机系统_哔哩哔哩_bilibili 目录 1.1.1 计算机系统硬件基本组成 1.1.2 中央处理单元 1.CPU 的功能 1)运算器 2)控制器 RISC && CISC 流水线控制 存储器  Cache 中断 输入输出IO控制方式 程序查询方式 中断驱动方式 直接存储器方式(DMA)  ​编辑 总线 ​编辑

BUUCTF靶场[web][极客大挑战 2019]Http、[HCTF 2018]admin

目录   [web][极客大挑战 2019]Http 考点:Referer协议、UA协议、X-Forwarded-For协议 [web][HCTF 2018]admin 考点:弱密码字典爆破 四种方法:   [web][极客大挑战 2019]Http 考点:Referer协议、UA协议、X-Forwarded-For协议 访问环境 老规矩,我们先查看源代码

计算机毕业设计 大学志愿填报系统 Java+SpringBoot+Vue 前后端分离 文档报告 代码讲解 安装调试

🍊作者:计算机编程-吉哥 🍊简介:专业从事JavaWeb程序开发,微信小程序开发,定制化项目、 源码、代码讲解、文档撰写、ppt制作。做自己喜欢的事,生活就是快乐的。 🍊心愿:点赞 👍 收藏 ⭐评论 📝 🍅 文末获取源码联系 👇🏻 精彩专栏推荐订阅 👇🏻 不然下次找不到哟~Java毕业设计项目~热门选题推荐《1000套》 目录 1.技术选型 2.开发工具 3.功能

【STM32】SPI通信-软件与硬件读写SPI

SPI通信-软件与硬件读写SPI 软件SPI一、SPI通信协议1、SPI通信2、硬件电路3、移位示意图4、SPI时序基本单元(1)开始通信和结束通信(2)模式0---用的最多(3)模式1(4)模式2(5)模式3 5、SPI时序(1)写使能(2)指定地址写(3)指定地址读 二、W25Q64模块介绍1、W25Q64简介2、硬件电路3、W25Q64框图4、Flash操作注意事项软件SPI读写W2