logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

HunyuanVideo-Foley Docker镜像获取与部署指南

腾讯混元团队推出的HunyuanVideo-Foley支持AI自动生成匹配视频画面的音效,本文详解如何拉取Docker镜像,配置CPU/GPU运行模式,并通过Python调用API实现自动化音效生成,同时提供生产级docker-compose部署方案。

Qwen3-32B Kubernetes集群部署最佳实践

本文分享在Kubernetes集群中高效部署Qwen3-32B大模型的完整实践,涵盖vLLM优化、PagedAttention显存管理、冷启动加速、自定义HPA扩缩容、健康检查策略及可观测性建设,解决高并发、长上下文推理中的稳定性与性能瓶颈。

#vLLM
Seed-Coder-8B-Base模型对AWS Lambda代码的支持

Seed-Coder-8B-Base是一款专为代码生成优化的轻量级大模型,支持在单张T4显卡上高效运行,可精准生成符合AWS最佳实践的Lambda函数。它具备强上下文感知与语法约束能力,能自动补全代码、生成函数体并推荐最佳实践,显著提升无服务器应用开发效率。

如何利用GPT-OSS-20B降低大模型推理成本?

本文介绍如何通过GPT-OSS-20B实现低成本、高性能的大模型推理。该模型采用稀疏激活、知识蒸馏、剪枝与量化技术,可在16GB内存设备上运行,支持结构化输出,显著降低部署成本并保障数据隐私。

ComfyUI云端部署方案:基于容器化技术的弹性扩展实践

本文探讨基于容器化技术的ComfyUI云端部署方案,涵盖Docker封装、Kubernetes编排、自动扩缩容、资源隔离与安全加固等核心实践,助力AIGC服务实现高可用、可观测与弹性伸缩的生产级能力。

#ComfyUI
Docker中TensorFlow-GPU调用问题全解析

本文详细记录了在Docker容器中部署TensorFlow-GPU时遇到的各类问题,包括CUDA驱动、libcuda.so缺失、TensorRT未找到等典型错误,并提供完整的解决方案。通过环境变量设置、库文件挂载、软链接处理及依赖安装等方式,实现GPU的正确识别与调用。

FRCRN语音降噪工具开源实践:在私有云中部署合规可控的语音处理服务

本文介绍了如何在星图GPU平台上自动化部署FRCRN语音降噪工具(单麦-16k)镜像,快速构建私有化语音处理服务。该方案能有效去除会议、录音中的背景噪音,提升音频清晰度,适用于在线会议、内容创作及语音识别预处理等场景,确保数据安全与处理效率。

Linly-Talker与昆仑万维天工大模型协作案例

通过Linly-Talker与昆仑万维‘天工’大模型的深度协作,构建具备语音识别、语义理解、语音合成与精准唇动同步能力的AI数字人,已在电商直播、智能客服等场景实现低延迟、高拟真的规模化落地。

ollama部署本地大模型|granite-4.0-h-350m在内容审核系统中的文本分类实践

本文介绍了如何在星图GPU平台自动化部署【ollama】granite-4.0-h-350m镜像,实现高效的本地大模型文本分类。该轻量级模型特别适用于内容审核场景,能快速识别违规文本、广告及多语言混合内容,提升审核效率与准确性,为社交媒体和电商平台提供智能化解决方案。

利用Dify开源平台实现低代码大模型应用开发全流程解析

Dify通过可视化编排降低大模型应用开发门槛,将RAG、Agent等复杂技术封装为可拖拽模块,实现知识问答、多步决策等场景的快速搭建。平台支持私有化部署、工具集成与权限管控,让非技术人员也能参与AI流程设计,显著提升企业AI落地效率。

#低代码
    共 866 条
  • 1
  • 2
  • 3
  • 87
  • 请选择