logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Qwen3-Embedding-8B 模型快速部署与调用指南

在本地部署大语言模型进行文本嵌入和检索,已经成为许多开发者构建私有知识库、提升应用智能化水平的首选方案。相比于依赖云端 API,本地部署不仅数据完全可控,还能在离线环境下稳定运行,特别适合处理敏感文档或需要低延迟响应的场景。然而,从环境配置到最终实现高效的向量检索,中间涉及不少技术细节:如何选择合适的运行库?模型文件该放在哪里?面对海量数据如何批量处理而不爆显存?遇到报错又该如何快速定位?

#python
Milvus 结合 Qwen3-Embedding-8B 相似度检索实战指南

在本地搭建一套完整的向量检索系统,往往是许多开发者从理论走向实践的关键一步。很多时候,我们手头有一堆非结构化的文本数据,想要快速实现“以文搜文”的功能,却常常卡在环境配置复杂、模型加载失败或者检索结果不准确这些琐碎问题上。特别是当涉及到像 Qwen3-Embedding-8B 这样的大参数模型时,显存管理和推理速度的平衡更是一个不小的挑战。其实,只要理清了从环境准备到最终检索优化的完整链路,整个过

#milvus#全文检索
FunASR 快速部署与调用指南

FunASR 是阿里巴巴达摩院与中科院自动化所联合开源的工业级语音识别工具包,集成了自动语音识别(ASR)、语音活动检测(VAD)、标点恢复、说话人验证、说话人日志、情感与事件检测等多重功能。它支持从嵌入式设备到云服务器的全场景部署,并提供 OpenAI 兼容的 API 服务。本文将系统介绍 FunASR 的部署与调用方法,涵盖多种部署路径、技术架构、性能优化和实用技巧。

#语音识别#人工智能#python
MIS-TEI 安装与部署完整指南

MIS-TEI 是华为推出的基于昇腾 AI 处理器的文本嵌入推理(Text Embeddings Inference)解决方案,专为 Embedding 和 Reranker 类模型优化。它支持容器化快速部署、动态批处理和硬件加速,广泛应用于检索增强生成(RAG)、语义搜索等场景,是昇腾设备上部署文本嵌入模型的主流方案之一。

#人工智能#python#自然语言处理
MIS-TEI 安装与部署完整指南

MIS-TEI 是华为推出的基于昇腾 AI 处理器的文本嵌入推理(Text Embeddings Inference)解决方案,专为 Embedding 和 Reranker 类模型优化。它支持容器化快速部署、动态批处理和硬件加速,广泛应用于检索增强生成(RAG)、语义搜索等场景,是昇腾设备上部署文本嵌入模型的主流方案之一。

#人工智能#python#自然语言处理
Qwen3-ASR生产级部署文档

Qwen3-ASR是阿里通义千问团队开源的语音识别模型系列,支持52种语言和方言的识别、自动语言检测、字/词级时间戳对齐,以及流式/离线两种推理模式。生产级部署方案采用All-in-One Docker镜像,将Qwen3-ASR(1.7B/0.6B)和强制对齐模型Qwen3-ForcedAligner-0.6B打包在一起,实现“运行时零下载”。对于10-20分钟的音频文件,如遇处理异常,需检查分段

#语音识别
vLLM-Ascend 快速部署与调用指南

摘要:本文详细介绍了在国产昇腾(Ascend)AI处理器上部署vLLM推理服务的关键步骤和注意事项。首先强调了环境准备的重要性,包括操作系统版本、Python虚拟环境创建及昇腾版PyTorch的安装。随后讲解了Ascend驱动与CANN工具包的配置细节,以及如何正确设置环境变量。源码编译vLLM-Ascend时需指定编译标志,并处理可能出现的依赖问题。模型加载和服务启动阶段需调整显存管理和精度参数

#python#人工智能
vLLM-Ascend 快速部署与调用指南

摘要:本文详细介绍了在国产昇腾(Ascend)AI处理器上部署vLLM推理服务的关键步骤和注意事项。首先强调了环境准备的重要性,包括操作系统版本、Python虚拟环境创建及昇腾版PyTorch的安装。随后讲解了Ascend驱动与CANN工具包的配置细节,以及如何正确设置环境变量。源码编译vLLM-Ascend时需指定编译标志,并处理可能出现的依赖问题。模型加载和服务启动阶段需调整显存管理和精度参数

#python#人工智能
vLLM-Ascend 快速部署与调用指南

摘要:本文详细介绍了在国产昇腾(Ascend)AI处理器上部署vLLM推理服务的关键步骤和注意事项。首先强调了环境准备的重要性,包括操作系统版本、Python虚拟环境创建及昇腾版PyTorch的安装。随后讲解了Ascend驱动与CANN工具包的配置细节,以及如何正确设置环境变量。源码编译vLLM-Ascend时需指定编译标志,并处理可能出现的依赖问题。模型加载和服务启动阶段需调整显存管理和精度参数

#python#人工智能
vLLM-Ascend 快速部署与调用指南

摘要:本文详细介绍了在国产昇腾(Ascend)AI处理器上部署vLLM推理服务的关键步骤和注意事项。首先强调了环境准备的重要性,包括操作系统版本、Python虚拟环境创建及昇腾版PyTorch的安装。随后讲解了Ascend驱动与CANN工具包的配置细节,以及如何正确设置环境变量。源码编译vLLM-Ascend时需指定编译标志,并处理可能出现的依赖问题。模型加载和服务启动阶段需调整显存管理和精度参数

#python#人工智能
    共 18 条
  • 1
  • 2
  • 请选择