顶顶通热词模型配置热词方法(mod_cti基于FreeSWITCH)

2024-09-01 22:20

本文主要是介绍顶顶通热词模型配置热词方法(mod_cti基于FreeSWITCH),希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

文章目录

  • 前言
  • 热词文件
  • 模型下载
    • 实时热词模型(对接mod_cti)
    • 一句话热词模型(对接mod_vad)


前言

在语音转文字时,如果在您的业务领域有一些特有的词,默认识别效果较差的时候可以考虑使用热词模型功能,把这些词添加到一个热词文件中,可以改善这些词的识别结果。这种方式配置后,就可以生效。

也可以处理同音词,例如:王小明和王晓铭,通常普通模型会识别成 “王小明”,如果把 “王晓铭” 这个名字添加到热词文件中,就可以优先识别成 “王晓铭”。

但热词模型也有缺点:相较于普通模型,热词模型识别更消耗CUP。


热词文件

  1. 在想要使用私有化热词模型之前,需要创建一个热词文件,类型:.txt。例如:hotword.txt
  2. 热词存放要求:
    • 一行一个热词
    • 热词尽量简短,不要过长。

例如:

福州
物流
包邮
  1. 上传至服务器中,可任意路径。推荐:上传至asrproxy程序目录中。

模型下载

实时热词模型(对接mod_cti)

  • SSH终端执行命令下载模型:
curl -s http://down.ddrj.com/getasrmodel.sh | bash -s paraformer-large-contextual paraformer-large-online
  • 配置asrproxy.json:将以下配置添加到asrproxy.json文件中的对应位置,需要配置哪些会以文字形式描述。
    "asr":{"listen_ip":"127.0.0.1", "listen_port":9988,"storage":"record", "acl":"*", "interface": {//实时热词模型的配置,从这里开始复制。"paraformer_contextual_16K": { "type": "funasr", "engine": "2pass", "quantize": true, "enable_itn": true, "itn-dir": "/ddt/asrproxy/funasr/fst_itn_zh", "vad-dir": "/ddt/asrproxy/funasr/speech_fsmn_vad_zh-cn-16k-common-onnx", "vad-quant": true, "punc-dir": "/ddt/asrproxy/funasr/punc_ct-transformer_zh-cn-common-vad_realtime-vocab272727-onnx", "model-dir": "/ddt/asrproxy/funasr/speech_paraformer-large-contextual_asr_nat-zh-cn-16k-common-vocab8404-onnx", "online-model-dir": "/ddt/asrproxy/funasr/speech_paraformer-large_asr_nat-zh-cn-16k-common-vocab8404-online-onnx", "lm-dir": "/ddt/asrproxy/funasr/speech_ngram_lm_zh-cn-ai-wesp-fst", "hotword": "",       //配置热词文件的地方,使用绝对路径。例如:hotword.txt热词文件上传在服务器的/ddt/asrproxy目录中,那么这里应该配置:/ddt/asrproxy/hotword.txt"chunk-size": 800}//复制到这里结束。然后把复制的这一段配置放在asrproxy.json文件的对应位置。},"groups":{"default":{ "mode":0, "enable": ["paraformer_contextual_16K"   //asrproxy.json文件的对应位置配置:paraformer_contextual_16K]}}

一句话热词模型(对接mod_vad)

  • SSH终端执行命令下载模型:
curl -s http://down.ddrj.com/getasrmodel.sh | bash -s paraformer-large-contextual
  • 配置asrproxy.json:将以下配置添加到asrproxy.json文件中的对应位置,需要配置哪些会以文字形式描述。
    "short_sentence_asr":{"listen_ip":"0.0.0.0", "listen_port":9990,"bgasr_thread_count":null, "users":{"test":{          "not_validate_signature":false,"key":"test","ip":"*"}}},//上面的这一段也需要复制到asrproxy.json文件中的对应位置。"asr":{"listen_ip":"127.0.0.1","listen_port":9988,"storage":"record","acl":"*", "interface": {//一句话热词模型配置,从这里开始复制。"contextual_16K": { "type": "funasr", "engine": "sentence", "quantize": true, "enable_itn": true, "itn-dir": "/ddt/asrproxy/funasr/fst_itn_zh", "vad-dir": "/ddt/asrproxy/funasr/speech_fsmn_vad_zh-cn-16k-common-onnx", "vad-quant": true, "punc-dir": "/ddt/asrproxy/funasr/punc_ct-transformer_zh-cn-common-vocab272727-onnx", "model-dir": "/ddt/asrproxy/funasr/speech_paraformer-large_asr_nat-zh-cn-16k-common-vocab8404-onnx", "online-model-dir": "", "lm-dir": "/ddt/asrproxy/funasr/speech_ngram_lm_zh-cn-ai-wesp-fst", "hotword": ""    //配置热词文件的地方,使用绝对路径。例如:hotword.txt热词文件上传在服务器的/ddt/asrproxy目录中,那么这里应该配置:/ddt/asrproxy/hotword.txt}//复制到这里结束。然后把复制的这一段配置放在asrproxy.json文件的对应位置。},"groups":{//从这里开始复制。"shortsentence":{"mode":0,"enable":["contextual_16K" ]}//复制到这里结束,然后把复制的这一段放在asrproxy.json配置文件中的asr.groups中。   }}

这篇关于顶顶通热词模型配置热词方法(mod_cti基于FreeSWITCH)的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1128209

相关文章

SpringCloud动态配置注解@RefreshScope与@Component的深度解析

《SpringCloud动态配置注解@RefreshScope与@Component的深度解析》在现代微服务架构中,动态配置管理是一个关键需求,本文将为大家介绍SpringCloud中相关的注解@Re... 目录引言1. @RefreshScope 的作用与原理1.1 什么是 @RefreshScope1.

macOS无效Launchpad图标轻松删除的4 种实用方法

《macOS无效Launchpad图标轻松删除的4种实用方法》mac中不在appstore上下载的应用经常在删除后它的图标还残留在launchpad中,并且长按图标也不会出现删除符号,下面解决这个问... 在 MACOS 上,Launchpad(也就是「启动台」)是一个便捷的 App 启动工具。但有时候,应

SpringBoot日志配置SLF4J和Logback的方法实现

《SpringBoot日志配置SLF4J和Logback的方法实现》日志记录是不可或缺的一部分,本文主要介绍了SpringBoot日志配置SLF4J和Logback的方法实现,文中通过示例代码介绍的非... 目录一、前言二、案例一:初识日志三、案例二:使用Lombok输出日志四、案例三:配置Logback一

springboot security之前后端分离配置方式

《springbootsecurity之前后端分离配置方式》:本文主要介绍springbootsecurity之前后端分离配置方式,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的... 目录前言自定义配置认证失败自定义处理登录相关接口匿名访问前置文章总结前言spring boot secu

一文详解SpringBoot响应压缩功能的配置与优化

《一文详解SpringBoot响应压缩功能的配置与优化》SpringBoot的响应压缩功能基于智能协商机制,需同时满足很多条件,本文主要为大家详细介绍了SpringBoot响应压缩功能的配置与优化,需... 目录一、核心工作机制1.1 自动协商触发条件1.2 压缩处理流程二、配置方案详解2.1 基础YAML

Python实现无痛修改第三方库源码的方法详解

《Python实现无痛修改第三方库源码的方法详解》很多时候,我们下载的第三方库是不会有需求不满足的情况,但也有极少的情况,第三方库没有兼顾到需求,本文将介绍几个修改源码的操作,大家可以根据需求进行选择... 目录需求不符合模拟示例 1. 修改源文件2. 继承修改3. 猴子补丁4. 追踪局部变量需求不符合很

springboot简单集成Security配置的教程

《springboot简单集成Security配置的教程》:本文主要介绍springboot简单集成Security配置的教程,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,... 目录集成Security安全框架引入依赖编写配置类WebSecurityConfig(自定义资源权限规则

Java的IO模型、Netty原理解析

《Java的IO模型、Netty原理解析》Java的I/O是以流的方式进行数据输入输出的,Java的类库涉及很多领域的IO内容:标准的输入输出,文件的操作、网络上的数据传输流、字符串流、对象流等,这篇... 目录1.什么是IO2.同步与异步、阻塞与非阻塞3.三种IO模型BIO(blocking I/O)NI

SpringBoot中封装Cors自动配置方式

《SpringBoot中封装Cors自动配置方式》:本文主要介绍SpringBoot中封装Cors自动配置方式,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录SpringBoot封装Cors自动配置背景实现步骤1. 创建 GlobalCorsProperties

Spring Boot结成MyBatis-Plus最全配置指南

《SpringBoot结成MyBatis-Plus最全配置指南》本文主要介绍了SpringBoot结成MyBatis-Plus最全配置指南,包括依赖引入、配置数据源、Mapper扫描、基本CRUD操... 目录前言详细操作一.创建项目并引入相关依赖二.配置数据源信息三.编写相关代码查zsRArly询数据库数