logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

开源ASR服务器vosk

概述近几年由于AI的迅速发展,语音相关的自然语言处理NLP项目也变多了,新的技术也越来越成熟,其中TTS(语音生成)和ASR(语音识别)是NLP中非常重要的环节。今天我们介绍一个开源的ASR项目vosk,以及vosk的简单应用方法。Vosk是开源的语音识别工具包。Vosk支持的事情包括:1. 支持十九种语言 - 中文,英语,印度英语,德语,法语,西班牙语,葡萄牙语,俄语,土耳其语,越南语,意大利语

文章图片
#语音识别
kamailio+rtpengine对sdp的处理

摘要:本文介绍了在Kamailio 5.8.3和RTPEngine 13.1.1.6环境下实现SDP信息定制处理的方案对比。需求包括修改代理IP、替换特定字段和删除特定行。通过测试比较两种方案发现:方案1在rtpengine_manage后处理SDP存在换行符问题,而方案2在rtpengine_manage前使用replace_body配合msg_apply_changes能完美实现需求。文章详细

文章图片
使用docker-compose管理freeswitch容器

之前的文章我们介绍过如何将freeswitch做成docker镜像,也使用命令行模式正常启动了fs的docker容器。但是当我们需要同时管理多个docker容器的时候,还是使用docker-compose更简单。docker-compose简化了多个docker容器的管理难度。对于docker集群的部署,使用docker-compose很方便。空空如常求真得真。

文章图片
#docker#容器#运维
vscode无法调试python2.7版本

好久没有用python2.7版本了,最近有个老的脚本要优化,但是发现vscode无法对脚本调试,特此记录下解决方法。本地安装有python2和python3,开发过程中,vscode可以随时调整python版本来适配代码。但是最近发现在vscode上,python3可以正常调试/运行,而python2可以运行,但无法调试,按‘F5‘之后,调试窗口闪了一下就消失了,终端输出中也没有任何消息。在‘bi

文章图片
#python#vscode#开发语言
freeswitch on centos dockerfile模式

freeswitch是一款简单好用的VOIP开源软交换平台。centos7 docker上编译安装fs的流程记录,本文使用dockerfile模式。centos系统后续的维护问题需要关注。centos和rocky的方向需要验证和抉择一下。空空如常求真得真。

文章图片
#centos#linux#docker
freeswitch的mod_xml_cdr模块

freeswitch是一款简单好用的VOIP开源软交换平台。在语音呼叫的过程中,话单是重要的计价和结算依据,话单的产生需要稳定可靠,可回溯。fs中的mod_xml_cdr模块提供了基本话单功能之外的选择,可以输出XML格式的本地话单或通过http post接口上传web服务器。mod_xml_cdr模块默认编译安装,但没有加载。检查conf/autoload_configs/modules.con

文章图片
#xml
freeswitch on centos dockerfile模式

freeswitch是一款简单好用的VOIP开源软交换平台。centos7 docker上编译安装fs的流程记录,本文使用dockerfile模式。centos系统后续的维护问题需要关注。centos和rocky的方向需要验证和抉择一下。空空如常求真得真。

文章图片
#centos#linux#docker
freeswitch tts_commandline模块介绍

概述freeswitch是开源、免费的VOIP软交换平台,自带了很多功能各异的模块。mod_tts_commandline模块,本身没有TTS能力,而是通过调用TTS引擎的命令生成语音文件,tts命令可以配置,最终实现自动TTS语音播放的功能。今天,我们介绍一下该模块的一般应用方法。环境centos:CentOS release 7.0 (Final)或以上版本freeswitch:v1.8.7G

文章图片
#c++
paddlespeech asr脚本demo

paddlespeech是百度飞桨平台的开源工具包,主要用于语音和音频的分析处理,其中包含多个可选模型,提供语音识别、语音合成、说话人验证、关键词识别、音频分类和语音翻译等功能。本文介绍利用ps中的asr功能实现批量处理音频文件的demo。ps的asr功能中有多个模型可选,目前测试中的“conformer_wenetspeech”识别准确率较高。识别速度有待提高,音频长度的限制也待解决。空空如常求

文章图片
#linux
到底了