logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

SenseVoice-small-onnx语音识别入门必看:支持mp3/wav/m4a/flac全格式

本文介绍了如何在星图GPU平台自动化部署sensevoice-small-语音识别-onnx模型(带量化后),实现高效语音识别。该模型支持mp3/wav/m4a/flac等多种音频格式,可快速应用于会议记录自动化、语音转文字等场景,提升内容处理效率。

#语音识别
Qwen3-ASR-0.6B效果展示:多人会议交叉说话场景下的说话人日志(SAD+Diarization)

本文介绍了如何在星图GPU平台上自动化部署🎙️ Qwen3-ASR-0.6B 智能语音识别镜像,高效处理多人会议交叉说话场景下的说话人日志(SAD+Diarization)。该镜像可一键生成带时间戳、角色标签和中英文原貌的结构化会议纪要,显著提升会议记录与需求梳理效率。

#语音识别
Qwen2.5-VL知识蒸馏:轻量化模型训练指南

本文介绍了如何在星图GPU平台上自动化部署基于 Qwen2.5-VL 的视觉定位chord视觉定位模型,实现高效、轻量化的多模态理解与视觉定位功能。该镜像适用于文档解析、发票信息提取等典型场景,显著提升结构化图文内容识别的准确率与推理速度。

Qwen3-VL-8B企业级应用:集成至OA系统实现‘文档上传→自动摘要→问答交互’闭环

本文介绍了如何在星图GPU平台上自动化部署Qwen3-VL-8B AI 聊天系统Web镜像,实现企业OA系统中文档上传→自动摘要→问答交互的智能闭环。该镜像可深度解析PDF、Word等多格式文档,生成结构化摘要并支持上下文连续问答,典型应用于合同审查、SOP学习与周报分析等办公场景。

使用Qwen3-ASR-1.7B实现语音控制机器人:ROS集成方案

本文介绍了如何在星图GPU平台上自动化部署🎙️ Qwen3-ASR-1.7B 高精度语音识别工具镜像,快速构建低延迟语音识别服务,典型应用于ROS机器人语音控制场景——将用户自然语音指令(如‘把客厅台灯调暗’)实时转为文本并驱动硬件执行,显著提升人机交互效率与可用性。

#语音识别
ChatGLM3-6B长文本处理实战:万字文档分析不求人

本文介绍了如何在星图GPU平台上自动化部署🤖 ChatGLM3-6B镜像,快速搭建本地长文本分析助手。该镜像基于ChatGLM3-6B-32k模型,拥有超长上下文处理能力,可应用于万字级技术报告、学术论文等文档的智能总结与深度问答,显著提升信息提炼效率。

ChatGLM3-6B 32k上下文教育应用:中学生物课全程问答+知识点图谱自动生成

本文介绍了如何在星图GPU平台上自动化部署🤖 ChatGLM3-6B镜像,赋能中学生物教学场景。通过该平台,教师可快速构建本地化AI助教,实现课堂实时问答、知识点图谱自动生成等核心功能,显著提升概念讲解与知识结构化效率。

#知识图谱
YOLOv8与Qwen3智能字幕系统的视频内容分析应用

本文介绍了如何利用星图GPU平台,自动化部署🎬 清音刻墨 · Qwen3 智能字幕对齐系统,并结合YOLOv8构建智能视频分析方案。该系统能自动识别视频中的物体与场景,并生成精准、连贯的字幕或内容摘要,可广泛应用于新闻视频自动摘要、教育视频智能解说等场景,显著提升视频内容的生产效率与可访问性。

Qwen3-ForcedAligner部署案例:开源镜像一键实现专业字幕对齐

本文介绍了如何在星图GPU平台上一键自动化部署🎬 清音刻墨 · Qwen3 智能字幕对齐系统镜像,实现高精度音视频字幕生成与对齐。该系统能自动处理音频文件,生成毫秒级精准的SRT字幕,大幅提升教育视频、会议记录等场景的字幕制作效率与质量。

Qwen-Image-Edit创意案例:用AI把照片变成艺术作品

本文介绍了如何在星图GPU平台上自动化部署Qwen-Image-Edit - 本地极速图像编辑系统镜像,实现‘一句话’将普通照片转化为艺术风格图像的创意应用。用户上传照片并输入自然语言指令(如‘改成梵高风格’),即可在本地GPU上秒级生成保留主体结构的高质量艺术化图像,适用于人像油画、街景赛博朋克化等典型创作场景。

    共 755 条
  • 1
  • 2
  • 3
  • 76
  • 请选择