百度CTO王海峰:语音能力日均调用量过100亿,AI技术在应用中进化

2023-10-09 14:40

本文主要是介绍百度CTO王海峰:语音能力日均调用量过100亿,AI技术在应用中进化,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

11月28日,百度大脑宣布语音能力引擎日均调用量已经超过100亿次,应用规模业界第一,为开发者提供了覆盖云、端、芯的全栈全场景语音开放能力,推动智能语音技术在各行业落地应用。

在当天举行的百度大脑语音能力引擎论坛上,百度大脑语音引擎全新发布和升级了14大产品内容,包括基于百度鸿鹄语音芯片的4款硬件模组、开发板及3大场景解决方案,升级了语音自训练平台、呼叫中心语音解决方案等。来自家电、农业、医疗等行业的合作伙伴代表也在现场分享了百度大脑语音技术赋能的成果。

     

▲ 百度 CTO 王海峰博士致辞

百度首席技术官王海峰博士出席论坛并致辞,他表示:“AI 技术的进化和产业赋能正向循环,相互促进,AI 在应用场景中不断进化。百度的语音技术基于深度学习和产业应用加速突破,已应用到百度 App、百度地图、小度音箱,百度输入法等百度产品,更通过 AI 开放平台赋能众多产业伙伴。百度大脑语音能力每天的调用量已经超过100亿。

现场,百度语音首席架构师贾磊正式提出基于复数 CNN 网络的语音增强和语音识别一体化端到端建模技术,该方法抛弃了数字信号处理学科和语音识别学科的各种先验假设,消除学科间壁垒,直接端到端进行一体化建模。相较于传统基于数字信号处理的麦克阵列算法,错误率降低超过30%。目前该方法已经被集成到百度最新发布的百度鸿鹄芯片中。  

▲ 百度语音首席架构师贾磊主题演讲:百度大脑语音技术的前沿进展

百度从2012年起就开始把深度学习用于中文语音搜索,成为全世界最早把深度学习技术落地工业化产品的企业之一。百度大脑目前已开放了云、端、芯包含语音识别、语音合成等全栈语音引擎能力,并广泛应用于金融、政务、文娱等多种行业和场景。

百度 AI 技术生态部总经理喻友平表示,百度大脑语音能力引擎的应用规模已达到业界第一,同时一直在积极拓展语音能力引擎生态链的建设。

 

▲ 百度 AI 技术生态部总经理喻友平介绍百度大脑语音引擎全栈开放能力

针对智能硬件设备,百度大脑重磅发布基于百度鸿鹄语音芯片的4款硬件模组、开发板,以及智能家居、智能车载、智能 IoT 设备3大端到端软硬一体远场语音交互场景解决方案,具备交互效果优异、软硬一体快速应用、广泛兼容集成门槛低等优点。

同时,在语音识别领域,全面升级短语音识别、实时语音识别能力,发布音频文件转写能力,升级可零代码提升业务术语识别率的语音自训练平台,以及呼叫中心语音解决方案;在语音合成方面,全新发布6个在线语音合成精品音库和5个离线语音合成精品音库。丰富的语音能力,助力智能硬件、互联网、呼叫中心等领域智能化升级。

▲ 嘉宾分享第一排从左至右:创维、瓴岳科技、北京子杰宝贝科技公司;第二排从左至右: 华智水稻、江西善行

论坛上,来自家居、金融、医疗、农业、公益等领域的合作伙伴,登台分享与百度大脑合作的细节,以及如何以语音技术助力自身完成智能化升级。

创维 AIoT 研究院产品经理李凯介绍:“大屏 IoT 的行业痛点在于信息检索难和设备控制操作复杂,通过增加语音交互能力,重构了整个 AIoT 设备生态的交互体验。双方在电视方面的合作成果已落地在10个电视芯片型号、2500万台电视上,助力中端及高端产品线提升了产品溢价能力。”在下一代远场语音方案中,百度鸿鹄语音芯片为创维产品带来了高性价比硬件、整合优化的软件算法等价值,双方将基于百度鸿鹄芯片展开多项产品的合作。

瓴岳科技信贷运营总监宋力现场分享了百度大脑语音技术在贷后领域的应用,依托百度大脑呼叫中心实时语音识别等 AI 服务对用户语音的准确识别,瓴岳打造了降本提效的智能机器人。通过贷后智能机器人、智能语音质检的应用,贷后人力投入降低61.47%,有效实现了合规和高效的运营体系,提高了客户体验。

北京子杰宝贝科技有限公司项目经理肖云峰在会上展现了语音技术在医疗领域的应用:“我们开发的智能录入系统在百度大脑语音自训练平台进行语音识别模型训练,识别率从80%提升至95%以上,包括医疗专业生僻词的识别,而很多厂商模型识别率都达不到这个要求。该系统有效降低了医护人员的工作强度,提升了临床护理效率。”

而在农业领域,也遇到了农业作物专业词汇语音识别率低的行业问题,对此华智生物信息技术主任龙晓波表示:“得益于百度大脑语音自训练平台使用简单、准确率高、可拓展等优点,经多次迭代我们的农业结构化性状数据语音识别准确率从71.09%提升至98.75%,采集一个测试田地性状信息从300人工时降低到160人工时,工作效率提升了一倍。”

善行智能联合创始人黄小瑰介绍了基于百度大脑语音等技术打造的小 Q 智能导盲眼镜,帮助盲人生活出行,为失能人群提供智能化的帮助。现场还发布了“因 AI 而声”公益计划:百度大脑将为提供公益性服务的公司或组织,提供语音技术免费、专属语音技术支持等福利,为特殊群体带去便利和帮助,让 AI 有温度。

▲ 百度大脑语音能力引擎论坛现场

百度大脑开放平台是国内服务规模最大的 AI 开放平台,目前已开放228项 AI 能力,拥有超过150万的开发者用户。

与会人士认为,此次百度大脑语音技术能力的全新发布和升级,为开发者和企业提供了更加完善的全栈语音引擎能力,将帮助更多用户高效打造具备语音交互能力的特色应用与产品,加快语音技术在各行各业的应用落地进程。

这篇关于百度CTO王海峰:语音能力日均调用量过100亿,AI技术在应用中进化的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/173556

相关文章

Ilya-AI分享的他在OpenAI学习到的15个提示工程技巧

Ilya(不是本人,claude AI)在社交媒体上分享了他在OpenAI学习到的15个Prompt撰写技巧。 以下是详细的内容: 提示精确化:在编写提示时,力求表达清晰准确。清楚地阐述任务需求和概念定义至关重要。例:不用"分析文本",而用"判断这段话的情感倾向:积极、消极还是中性"。 快速迭代:善于快速连续调整提示。熟练的提示工程师能够灵活地进行多轮优化。例:从"总结文章"到"用

AI绘图怎么变现?想做点副业的小白必看!

在科技飞速发展的今天,AI绘图作为一种新兴技术,不仅改变了艺术创作的方式,也为创作者提供了多种变现途径。本文将详细探讨几种常见的AI绘图变现方式,帮助创作者更好地利用这一技术实现经济收益。 更多实操教程和AI绘画工具,可以扫描下方,免费获取 定制服务:个性化的创意商机 个性化定制 AI绘图技术能够根据用户需求生成个性化的头像、壁纸、插画等作品。例如,姓氏头像在电商平台上非常受欢迎,

百度/小米/滴滴/京东,中台架构比较

小米中台建设实践 01 小米的三大中台建设:业务+数据+技术 业务中台--从业务说起 在中台建设中,需要规范化的服务接口、一致整合化的数据、容器化的技术组件以及弹性的基础设施。并结合业务情况,判定是否真的需要中台。 小米参考了业界优秀的案例包括移动中台、数据中台、业务中台、技术中台等,再结合其业务发展历程及业务现状,整理了中台架构的核心方法论,一是企业如何共享服务,二是如何为业务提供便利。

中文分词jieba库的使用与实景应用(一)

知识星球:https://articles.zsxq.com/id_fxvgc803qmr2.html 目录 一.定义: 精确模式(默认模式): 全模式: 搜索引擎模式: paddle 模式(基于深度学习的分词模式): 二 自定义词典 三.文本解析   调整词出现的频率 四. 关键词提取 A. 基于TF-IDF算法的关键词提取 B. 基于TextRank算法的关键词提取

水位雨量在线监测系统概述及应用介绍

在当今社会,随着科技的飞速发展,各种智能监测系统已成为保障公共安全、促进资源管理和环境保护的重要工具。其中,水位雨量在线监测系统作为自然灾害预警、水资源管理及水利工程运行的关键技术,其重要性不言而喻。 一、水位雨量在线监测系统的基本原理 水位雨量在线监测系统主要由数据采集单元、数据传输网络、数据处理中心及用户终端四大部分构成,形成了一个完整的闭环系统。 数据采集单元:这是系统的“眼睛”,

从去中心化到智能化:Web3如何与AI共同塑造数字生态

在数字时代的演进中,Web3和人工智能(AI)正成为塑造未来互联网的两大核心力量。Web3的去中心化理念与AI的智能化技术,正相互交织,共同推动数字生态的变革。本文将探讨Web3与AI的融合如何改变数字世界,并展望这一新兴组合如何重塑我们的在线体验。 Web3的去中心化愿景 Web3代表了互联网的第三代发展,它基于去中心化的区块链技术,旨在创建一个开放、透明且用户主导的数字生态。不同于传统

AI一键生成 PPT

AI一键生成 PPT 操作步骤 作为一名打工人,是不是经常需要制作各种PPT来分享我的生活和想法。但是,你们知道,有时候灵感来了,时间却不够用了!😩直到我发现了Kimi AI——一个能够自动生成PPT的神奇助手!🌟 什么是Kimi? 一款月之暗面科技有限公司开发的AI办公工具,帮助用户快速生成高质量的演示文稿。 无论你是职场人士、学生还是教师,Kimi都能够为你的办公文

csu 1446 Problem J Modified LCS (扩展欧几里得算法的简单应用)

这是一道扩展欧几里得算法的简单应用题,这题是在湖南多校训练赛中队友ac的一道题,在比赛之后请教了队友,然后自己把它a掉 这也是自己独自做扩展欧几里得算法的题目 题意:把题意转变下就变成了:求d1*x - d2*y = f2 - f1的解,很明显用exgcd来解 下面介绍一下exgcd的一些知识点:求ax + by = c的解 一、首先求ax + by = gcd(a,b)的解 这个

Andrej Karpathy最新采访:认知核心模型10亿参数就够了,AI会打破教育不公的僵局

夕小瑶科技说 原创  作者 | 海野 AI圈子的红人,AI大神Andrej Karpathy,曾是OpenAI联合创始人之一,特斯拉AI总监。上一次的动态是官宣创办一家名为 Eureka Labs 的人工智能+教育公司 ,宣布将长期致力于AI原生教育。 近日,Andrej Karpathy接受了No Priors(投资博客)的采访,与硅谷知名投资人 Sara Guo 和 Elad G

hdu1394(线段树点更新的应用)

题意:求一个序列经过一定的操作得到的序列的最小逆序数 这题会用到逆序数的一个性质,在0到n-1这些数字组成的乱序排列,将第一个数字A移到最后一位,得到的逆序数为res-a+(n-a-1) 知道上面的知识点后,可以用暴力来解 代码如下: #include<iostream>#include<algorithm>#include<cstring>#include<stack>#in