浙工大计算机学院 张晖,计算机(软件)学院师生张晖、郝翔参加语音领域的顶级会议INTERSPEECH 2019...

本文主要是介绍浙工大计算机学院 张晖,计算机(软件)学院师生张晖、郝翔参加语音领域的顶级会议INTERSPEECH 2019...,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

语音领域的顶级学术会议INTERSPEECH于2019年9月15-19日在奥地利第二大城市格拉茨召开,该会议由国际语音通讯协会(International Speech Communication Association)主办,是世界上规模最大、内容最全面的语音会议。今年恰逢INTERSPEECH成功举办20周年,会议以“Crossroads of Speech and Language”为主题,意在探讨语言多样性、应用多样性以及表达方式多样性,吸引了来自世界各地的2000多名学者及企业厂商代表。INTERSPEECH每年召开一次,被CCF(中国计算机学会)列为C类推荐会议。在本次会议上,我校计算机(软件)学院共有两篇论文被录用:

Investigation on cost function for monaural speech separation(刘允,张晖,张学良)

第一作者刘允为2016级研究生(已毕业)。本文探讨了机器学习中的评价指标与代价函数的不一致问题,提出了一种一致性度量方法,并从理论上和实践上证明了提出的方法的有效性,最终以此为基础确定了语音分离任务的最优代价函数。该方法对于消除机器学习中评价指标与代价函数的不一致问题具有普遍意义。

UNetGAN: A Robust Speech Enhancement Approach in Time Domain for Extremely Low Signal-to-noise Ratio Condition(郝翔,苏向东,王治愚,张晖,巴图斯仁)

第一作者郝翔为2018级研究生。本文在非常具有挑战性的极低信噪比下进行语音增强,提出了一种基于U-Net与生成对抗网络的方法,并可以直接在时域上完成映射。该方法极大地提升了极低信噪比下语音的质量与可懂度,甚至在某些特定噪声场景下,可以将原本无法被人听清的语音信号转换为可以被人听清进而能被理解的语音信号。

我校教师张晖与研究生郝翔分别作为两篇论文的代表前往奥地利格拉茨参加了此次会议。

ed8454a1f1556f90e60337d5e925bfbc.png

d3fe698cc370002dc46e4b4b8b986a6c.png

0f05a22dd746b1b2e9a74cb3a7695893.png

上述论文的研究工作得到了国家自然科学基金、内蒙古自治区自然科学基金以及内蒙古大学综合能力提升项目的资助。

这篇关于浙工大计算机学院 张晖,计算机(软件)学院师生张晖、郝翔参加语音领域的顶级会议INTERSPEECH 2019...的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/220915

相关文章

阿里开源语音识别SenseVoiceWindows环境部署

SenseVoice介绍 SenseVoice 专注于高精度多语言语音识别、情感辨识和音频事件检测多语言识别: 采用超过 40 万小时数据训练,支持超过 50 种语言,识别效果上优于 Whisper 模型。富文本识别:具备优秀的情感识别,能够在测试数据上达到和超过目前最佳情感识别模型的效果。支持声音事件检测能力,支持音乐、掌声、笑声、哭声、咳嗽、喷嚏等多种常见人机交互事件进行检测。高效推

让树莓派智能语音助手实现定时提醒功能

最初的时候是想直接在rasa 的chatbot上实现,因为rasa本身是带有remindschedule模块的。不过经过一番折腾后,忽然发现,chatbot上实现的定时,语音助手不一定会有响应。因为,我目前语音助手的代码设置了长时间无应答会结束对话,这样一来,chatbot定时提醒的触发就不会被语音助手获悉。那怎么让语音助手也具有定时提醒功能呢? 我最后选择的方法是用threading.Time

软件设计师备考——计算机系统

学习内容源自「软件设计师」 上午题 #1 计算机系统_哔哩哔哩_bilibili 目录 1.1.1 计算机系统硬件基本组成 1.1.2 中央处理单元 1.CPU 的功能 1)运算器 2)控制器 RISC && CISC 流水线控制 存储器  Cache 中断 输入输出IO控制方式 程序查询方式 中断驱动方式 直接存储器方式(DMA)  ​编辑 总线 ​编辑

BUUCTF靶场[web][极客大挑战 2019]Http、[HCTF 2018]admin

目录   [web][极客大挑战 2019]Http 考点:Referer协议、UA协议、X-Forwarded-For协议 [web][HCTF 2018]admin 考点:弱密码字典爆破 四种方法:   [web][极客大挑战 2019]Http 考点:Referer协议、UA协议、X-Forwarded-For协议 访问环境 老规矩,我们先查看源代码

计算机毕业设计 大学志愿填报系统 Java+SpringBoot+Vue 前后端分离 文档报告 代码讲解 安装调试

🍊作者:计算机编程-吉哥 🍊简介:专业从事JavaWeb程序开发,微信小程序开发,定制化项目、 源码、代码讲解、文档撰写、ppt制作。做自己喜欢的事,生活就是快乐的。 🍊心愿:点赞 👍 收藏 ⭐评论 📝 🍅 文末获取源码联系 👇🏻 精彩专栏推荐订阅 👇🏻 不然下次找不到哟~Java毕业设计项目~热门选题推荐《1000套》 目录 1.技术选型 2.开发工具 3.功能

【STM32】SPI通信-软件与硬件读写SPI

SPI通信-软件与硬件读写SPI 软件SPI一、SPI通信协议1、SPI通信2、硬件电路3、移位示意图4、SPI时序基本单元(1)开始通信和结束通信(2)模式0---用的最多(3)模式1(4)模式2(5)模式3 5、SPI时序(1)写使能(2)指定地址写(3)指定地址读 二、W25Q64模块介绍1、W25Q64简介2、硬件电路3、W25Q64框图4、Flash操作注意事项软件SPI读写W2

AI(文生语音)-TTS 技术线路探索学习:从拼接式参数化方法到Tacotron端到端输出

AI(文生语音)-TTS 技术线路探索学习:从拼接式参数化方法到Tacotron端到端输出 在数字化时代,文本到语音(Text-to-Speech, TTS)技术已成为人机交互的关键桥梁,无论是为视障人士提供辅助阅读,还是为智能助手注入声音的灵魂,TTS 技术都扮演着至关重要的角色。从最初的拼接式方法到参数化技术,再到现今的深度学习解决方案,TTS 技术经历了一段长足的进步。这篇文章将带您穿越时

免费也能高质量!2024年免费录屏软件深度对比评测

我公司因为客户覆盖面广的原因经常会开远程会议,有时候说的内容比较广需要引用多份的数据,我记录起来有一定难度,所以一般都用录屏工具来记录会议内容。这次我们来一起探索有什么免费录屏工具可以提高我们的工作效率吧。 1.福晰录屏大师 链接直达:https://www.foxitsoftware.cn/REC/  录屏软件录屏功能就是本职,这款录屏工具在录屏模式上提供了多种选项,可以选择屏幕录制、窗口

Java 后端接口入参 - 联合前端VUE 使用AES完成入参出参加密解密

加密效果: 解密后的数据就是正常数据: 后端:使用的是spring-cloud框架,在gateway模块进行操作 <dependency><groupId>com.google.guava</groupId><artifactId>guava</artifactId><version>30.0-jre</version></dependency> 编写一个AES加密

HomeBank:开源免费的个人财务管理软件

在个人财务管理领域,找到一个既免费又开源的解决方案并非易事。HomeBank&nbsp;正是这样一个项目,它不仅提供了强大的功能,还拥有一个活跃的社区,不断推动其发展和完善。 开源免费:HomeBank 是一个完全开源的项目,用户可以自由地使用、修改和分发。用户友好的界面:提供直观的图形用户界面,使得非技术用户也能轻松上手。数据导入支持:支持从 Quicken、Microsoft Money