logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Linux中部署Qwen3.5大模型

Linux中部署Qwen3.5大模型 | 本地私有化部署阿里最新开源Qwen3.5大模型 | 私有化部署本地大模型需要什么配置

文章图片
#linux#运维#服务器 +1
ASR数据集采集系统 | ASR方言数据集采集系统 | ASR方言数据集采集系统 | 语音识别数据集采集系统

摘要 本文介绍了一个ASR(自动语音识别)数据集采集系统的开发与部署方案。该系统旨在解决传统数据采集过程中音频与文本标签不匹配的问题,通过云端部署实现多人协作采集,提高数据质量和采集效率。系统采用前后端分离架构:后端使用SpringBoot(JDK21),前端使用Vue,配合Nginx作为Web服务器和反向代理,MySQL存储数据并支持Excel导出。 部署过程详细说明了JDK21、MySQL和N

文章图片
#语音识别
Fun-ASR-Nano实时语音识别并区分说话人 | FunASR | 开源实时语音识别模型

Fun-ASR-Nano是一款开源实时语音识别模型,支持多种方言和国际语言,包括客家话、吴语、英语等。该模型具备流式区分说话人功能,可实时转写并标注不同说话人(SPK标识)及时间戳,适用于会议纪要等场景。效果演示视频可在B站观看。

#语音识别#人工智能
OpenAI Whisper内网无网络环境运行 | 开源Whisper本地化部署运行 | 语音识别ASR本地化

摘要:OpenAI开源的Whisper是一个强大的多语言ASR(自动语音识别)工具,支持100种语言(国内支持普通话和粤语),具备语音转写、标点添加、语种识别和翻译功能。该项目提供多种模型选择(如tiny、base、small、large系列),推荐使用优化后的large-v3-turbo模型(需8GB显存)。软件提供Windows可执行程序,支持CPU/GPU运行(GPU需英伟达CUDA)。Wh

文章图片
#语音识别#人工智能
SenseVoiceSmall区分说话人语音识别在通话录音转写中的优化

这是关于阿里开源的FunASR部署SenseVoiceSmall模型并准确区分说话人的一篇文章,主要记录如何提升区分说话人的准确率,以及如何在生产中提高SenseVoiceSmall的并发能力。

#语音识别#人工智能#python
OpenAI Whisper内网无网络环境运行 | 开源Whisper本地化部署运行 | 语音识别ASR本地化

摘要:OpenAI开源的Whisper是一个强大的多语言ASR(自动语音识别)工具,支持100种语言(国内支持普通话和粤语),具备语音转写、标点添加、语种识别和翻译功能。该项目提供多种模型选择(如tiny、base、small、large系列),推荐使用优化后的large-v3-turbo模型(需8GB显存)。软件提供Windows可执行程序,支持CPU/GPU运行(GPU需英伟达CUDA)。Wh

文章图片
#语音识别#人工智能
Linux中部署GPT-OSS-20B大模型 | openai_harmony.HarmonyError报错解决方案

这篇文章主要讲述如何在Linux服务器中内网部署gpt-oss-20b大模型,这个gpt-oss-20大模型只需要16GB显存,可以在本地电脑中部署,也可以在服务器中部署,然后有60GB以上的显存,可以跑gpt-oss-120b参数量的大模型。

#linux#运维
FunASR实时语音识别Websocket接口在Linux服务器中部署教程

本文介绍了如何在Linux系统上部署FunASR实时语音识别接口。FunASR是阿里巴巴开源的支持实时语音识别、说话人区分等功能的高效工具。部署过程以Ubuntu为例,通过Docker镜像快速搭建环境,包含镜像导入、服务启动等关键步骤,并提供了Web端演示方法。文章还提示了云服务器端口开放等注意事项,适用于通话转写、会议记录等场景。文末附有博客链接和视频教程,提供有偿部署服务联系方式。

#服务器#语音识别#linux
部署DeepSeek-OCR-2

本文介绍了DeepSeek-OCR-2的安装部署流程:1)克隆代码仓库并创建Python3.12.9虚拟环境;2)安装PyTorch 2.6.0、vLLM 0.8.5等依赖,需手动下载flash-attn 2.7.3的whl文件;3)修改config.py配置文件中的模型路径和输入输出路径。文中提供了详细命令和问题解决方法,并附有相关资源链接。作者还提供有偿部署服务,适合遇到部署困难的用户。

基于FunASR开发的可私有化部署的语音转文字接口 | FunASR接口开发 | 语音识别接口私有化部署

本文介绍了基于阿里开源FunASR开发的语音识别API项目FunASR_API。该项目支持Linux、MacOS和Windows系统,通过FastAPI提供HTTP接口,数据存储于MySQL,可被Java、C++、PHP等多种语言调用。文档详细说明了环境配置步骤,包括安装显卡驱动、CUDA、FFmpeg和Miniconda,创建Python虚拟环境并安装依赖库。项目提供三个核心接口:/asr用于直

#语音识别#人工智能#python +1
    共 45 条
  • 1
  • 2
  • 3
  • 4
  • 5
  • 请选择