顶顶通热词模型配置热词方法(mod_cti基于FreeSWITCH)

2024-09-01 22:20

本文主要是介绍顶顶通热词模型配置热词方法(mod_cti基于FreeSWITCH),希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

文章目录

  • 前言
  • 热词文件
  • 模型下载
    • 实时热词模型(对接mod_cti)
    • 一句话热词模型(对接mod_vad)


前言

在语音转文字时,如果在您的业务领域有一些特有的词,默认识别效果较差的时候可以考虑使用热词模型功能,把这些词添加到一个热词文件中,可以改善这些词的识别结果。这种方式配置后,就可以生效。

也可以处理同音词,例如:王小明和王晓铭,通常普通模型会识别成 “王小明”,如果把 “王晓铭” 这个名字添加到热词文件中,就可以优先识别成 “王晓铭”。

但热词模型也有缺点:相较于普通模型,热词模型识别更消耗CUP。


热词文件

  1. 在想要使用私有化热词模型之前,需要创建一个热词文件,类型:.txt。例如:hotword.txt
  2. 热词存放要求:
    • 一行一个热词
    • 热词尽量简短,不要过长。

例如:

福州
物流
包邮
  1. 上传至服务器中,可任意路径。推荐:上传至asrproxy程序目录中。

模型下载

实时热词模型(对接mod_cti)

  • SSH终端执行命令下载模型:
curl -s http://down.ddrj.com/getasrmodel.sh | bash -s paraformer-large-contextual paraformer-large-online
  • 配置asrproxy.json:将以下配置添加到asrproxy.json文件中的对应位置,需要配置哪些会以文字形式描述。
    "asr":{"listen_ip":"127.0.0.1", "listen_port":9988,"storage":"record", "acl":"*", "interface": {//实时热词模型的配置,从这里开始复制。"paraformer_contextual_16K": { "type": "funasr", "engine": "2pass", "quantize": true, "enable_itn": true, "itn-dir": "/ddt/asrproxy/funasr/fst_itn_zh", "vad-dir": "/ddt/asrproxy/funasr/speech_fsmn_vad_zh-cn-16k-common-onnx", "vad-quant": true, "punc-dir": "/ddt/asrproxy/funasr/punc_ct-transformer_zh-cn-common-vad_realtime-vocab272727-onnx", "model-dir": "/ddt/asrproxy/funasr/speech_paraformer-large-contextual_asr_nat-zh-cn-16k-common-vocab8404-onnx", "online-model-dir": "/ddt/asrproxy/funasr/speech_paraformer-large_asr_nat-zh-cn-16k-common-vocab8404-online-onnx", "lm-dir": "/ddt/asrproxy/funasr/speech_ngram_lm_zh-cn-ai-wesp-fst", "hotword": "",       //配置热词文件的地方,使用绝对路径。例如:hotword.txt热词文件上传在服务器的/ddt/asrproxy目录中,那么这里应该配置:/ddt/asrproxy/hotword.txt"chunk-size": 800}//复制到这里结束。然后把复制的这一段配置放在asrproxy.json文件的对应位置。},"groups":{"default":{ "mode":0, "enable": ["paraformer_contextual_16K"   //asrproxy.json文件的对应位置配置:paraformer_contextual_16K]}}

一句话热词模型(对接mod_vad)

  • SSH终端执行命令下载模型:
curl -s http://down.ddrj.com/getasrmodel.sh | bash -s paraformer-large-contextual
  • 配置asrproxy.json:将以下配置添加到asrproxy.json文件中的对应位置,需要配置哪些会以文字形式描述。
    "short_sentence_asr":{"listen_ip":"0.0.0.0", "listen_port":9990,"bgasr_thread_count":null, "users":{"test":{          "not_validate_signature":false,"key":"test","ip":"*"}}},//上面的这一段也需要复制到asrproxy.json文件中的对应位置。"asr":{"listen_ip":"127.0.0.1","listen_port":9988,"storage":"record","acl":"*", "interface": {//一句话热词模型配置,从这里开始复制。"contextual_16K": { "type": "funasr", "engine": "sentence", "quantize": true, "enable_itn": true, "itn-dir": "/ddt/asrproxy/funasr/fst_itn_zh", "vad-dir": "/ddt/asrproxy/funasr/speech_fsmn_vad_zh-cn-16k-common-onnx", "vad-quant": true, "punc-dir": "/ddt/asrproxy/funasr/punc_ct-transformer_zh-cn-common-vocab272727-onnx", "model-dir": "/ddt/asrproxy/funasr/speech_paraformer-large_asr_nat-zh-cn-16k-common-vocab8404-onnx", "online-model-dir": "", "lm-dir": "/ddt/asrproxy/funasr/speech_ngram_lm_zh-cn-ai-wesp-fst", "hotword": ""    //配置热词文件的地方,使用绝对路径。例如:hotword.txt热词文件上传在服务器的/ddt/asrproxy目录中,那么这里应该配置:/ddt/asrproxy/hotword.txt}//复制到这里结束。然后把复制的这一段配置放在asrproxy.json文件的对应位置。},"groups":{//从这里开始复制。"shortsentence":{"mode":0,"enable":["contextual_16K" ]}//复制到这里结束,然后把复制的这一段放在asrproxy.json配置文件中的asr.groups中。   }}

这篇关于顶顶通热词模型配置热词方法(mod_cti基于FreeSWITCH)的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1128209

相关文章

Java中流式并行操作parallelStream的原理和使用方法

《Java中流式并行操作parallelStream的原理和使用方法》本文详细介绍了Java中的并行流(parallelStream)的原理、正确使用方法以及在实际业务中的应用案例,并指出在使用并行流... 目录Java中流式并行操作parallelStream0. 问题的产生1. 什么是parallelS

MySQL数据库双机热备的配置方法详解

《MySQL数据库双机热备的配置方法详解》在企业级应用中,数据库的高可用性和数据的安全性是至关重要的,MySQL作为最流行的开源关系型数据库管理系统之一,提供了多种方式来实现高可用性,其中双机热备(M... 目录1. 环境准备1.1 安装mysql1.2 配置MySQL1.2.1 主服务器配置1.2.2 从

Python版本信息获取方法详解与实战

《Python版本信息获取方法详解与实战》在Python开发中,获取Python版本号是调试、兼容性检查和版本控制的重要基础操作,本文详细介绍了如何使用sys和platform模块获取Python的主... 目录1. python版本号获取基础2. 使用sys模块获取版本信息2.1 sys模块概述2.1.1

Python实现字典转字符串的五种方法

《Python实现字典转字符串的五种方法》本文介绍了在Python中如何将字典数据结构转换为字符串格式的多种方法,首先可以通过内置的str()函数进行简单转换;其次利用ison.dumps()函数能够... 目录1、使用json模块的dumps方法:2、使用str方法:3、使用循环和字符串拼接:4、使用字符

Python版本与package版本兼容性检查方法总结

《Python版本与package版本兼容性检查方法总结》:本文主要介绍Python版本与package版本兼容性检查方法的相关资料,文中提供四种检查方法,分别是pip查询、conda管理、PyP... 目录引言为什么会出现兼容性问题方法一:用 pip 官方命令查询可用版本方法二:conda 管理包环境方法

Linux云服务器手动配置DNS的方法步骤

《Linux云服务器手动配置DNS的方法步骤》在Linux云服务器上手动配置DNS(域名系统)是确保服务器能够正常解析域名的重要步骤,以下是详细的配置方法,包括系统文件的修改和常见问题的解决方案,需要... 目录1. 为什么需要手动配置 DNS?2. 手动配置 DNS 的方法方法 1:修改 /etc/res

mysql8.0.43使用InnoDB Cluster配置主从复制

《mysql8.0.43使用InnoDBCluster配置主从复制》本文主要介绍了mysql8.0.43使用InnoDBCluster配置主从复制,文中通过示例代码介绍的非常详细,对大家的学习或者... 目录1、配置Hosts解析(所有服务器都要执行)2、安装mysql shell(所有服务器都要执行)3、

JavaScript对象转数组的三种方法实现

《JavaScript对象转数组的三种方法实现》本文介绍了在JavaScript中将对象转换为数组的三种实用方法,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友... 目录方法1:使用Object.keys()和Array.map()方法2:使用Object.entr

SpringBoot中ResponseEntity的使用方法举例详解

《SpringBoot中ResponseEntity的使用方法举例详解》ResponseEntity是Spring的一个用于表示HTTP响应的全功能对象,它可以包含响应的状态码、头信息及响应体内容,下... 目录一、ResponseEntity概述基本特点:二、ResponseEntity的基本用法1. 创

java中判断json key是否存在的几种方法

《java中判断jsonkey是否存在的几种方法》在使用Java处理JSON数据时,如何判断某一个key是否存在?本文就来介绍三种方法,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的... 目http://www.chinasem.cn录第一种方法是使用 jsONObject 的 has 方法