logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Qwen3-VL-32B 在昇腾服务器上的部署与性能调优实战:基于 vllm-ascend 的多模态推理优化实践

本文介绍了Qwen3-VL-32B 在昇腾910B上的使用vLLM-Ascend两种性能调优方法,以提高多模态模型在昇腾服务器上的性能

文章图片
#人工智能#服务器#安全 +1
Qwen3-VL-32B 在昇腾服务器上的部署与性能调优实战:基于 vllm-ascend 的多模态推理优化实践

本文介绍了Qwen3-VL-32B 在昇腾910B上的使用vLLM-Ascend两种性能调优方法,以提高多模态模型在昇腾服务器上的性能

文章图片
#人工智能#服务器#安全 +1
门店导购数字人落地实践:魔珐星云让让数字员工拥有实时服务能力

文章摘要:本文通过家电卖场智能屏对比实验,揭示数字人交互体验的核心差异。传统数字人侧重形象展示而交互生硬,魔珐星云打造的具身交互智能体则实现500ms低延迟响应、全双工对话和自然非语言反馈,使AI具备可表达、可交互的"身体"。作者以门店导购场景为例,演示如何通过魔珐星云平台快速构建支持实时打断、多模态表达的智能体,验证其在引导决策、动态响应方面的优势。数字人发展正从形象展示转向实时交互,具身智能技

文章图片
#人工智能
最新模型Qwen3.5系列模型GGUF量化版本的部署与使用

最近千问新推出的Qwen3.5系列模型,实现了行业内一次重要的技术突破——它首次打破多模态模型与单独大语言模型的割裂壁垒,采用原生融合架构而非“拼装式”设计,将视觉感知与语言推理能力深度整合在统一技术基座中,彻底解决了传统多模态模型“模块脱节、协同性差”的痛点。

文章图片
#python#人工智能#语言模型
文心智能体之如何创建自己想要的智能体

文章主要介绍如何创建和完善自己需要的文心智能体。

文章图片
#自然语言处理
最新模型Qwen3.5系列模型GGUF量化版本的部署与使用

最近千问新推出的Qwen3.5系列模型,实现了行业内一次重要的技术突破——它首次打破多模态模型与单独大语言模型的割裂壁垒,采用原生融合架构而非“拼装式”设计,将视觉感知与语言推理能力深度整合在统一技术基座中,彻底解决了传统多模态模型“模块脱节、协同性差”的痛点。

文章图片
#python#人工智能#语言模型
    共 19 条
  • 1
  • 2
  • 请选择