logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

清华大模型ChatGLM2-6B微调全流程详解与实战应用

ChatGLM2-6B是由清华大学智源研究院研发的一款开源大型语言模型,具备强大的中文理解和生成能力。该模型基于Transformer架构,参数量达60亿级别,支持多轮对话、文本生成、摘要、翻译等多种自然语言处理任务。相较于前代模型ChatGLM-6B,ChatGLM2-6B在推理效率、上下文理解能力和生成流畅度方面均有显著提升。在构建和实施微调流程的过程中,定义任务类型和准备高质量的数据集是至关

Qwen3-VL-8B支持Docker部署的完整指南

Qwen3-VL-8B作为轻量级多模态大模型,原生支持Docker容器化部署,显存占用低、推理高效,可在A10等GPU上快速启动。通过标准镜像一键运行,轻松集成至Kubernetes等云原生架构,显著降低环境依赖与运维成本。

Nanbeige 4.1-3B清爽WebUI部署:Kubernetes集群中水平扩展多实例方案

本文介绍了在星图GPU平台上自动化部署🌸 Nanbeige 4.1-3B Streamlit WebUI (极简清爽版)镜像的方案。该方案基于Kubernetes集群,可实现大模型对话服务的水平扩展,轻松应对多用户并发访问,为团队协作或在线AI助手等场景提供稳定、高性能的本地化部署支持。

深度学习抠图实战|CV-UNet Universal Matting镜像详解

本文介绍了基于“星图GPU”平台自动化部署CV-UNet Universal Matting基于UNET快速一键抠图批量抠图 二次开发构建by科哥镜像的完整方案。该镜像集成优化版U-Net模型,支持高效图像抠图,适用于电商商品去背景、内容创作素材处理等场景,实现AI驱动的自动化图像编辑与批量处理。

企业内网应用安全调用外部大模型的Taotoken接入方案

企业内网应用安全调用外部大模型的Taotoken接入方案 应用场景类,探讨具有安全合规要求的企业如何安全地引入AI能力,分析通过Taotoken平台统一接入的优势,包括可审计的API调用日志,可控的访问权限以及内部用量监控,场景会简述如何将Taotoken的API端点配置到企业内网应用的调用链中,并利用其路由能力保障服务高可用。 1. 企业引入AI能力的安全合规挑战 当企业计划将大模型能力集成到内

音诺ai翻译机运用LSM6DS3TR-C与跌落保护触发报警

音诺AI翻译机通过LSM6DS3TR-C六轴IMU实现跌落检测,结合自由落体与冲击特征,构建低功耗、高精度的运动感知安全机制。

vLLM能否支持模型微服务化拆分?SOA架构演进

本文探讨vLLM如何通过PagedAttention和连续批处理技术提升大模型推理效率,支持高并发、低延迟的微服务部署。结合Kubernetes与云原生架构,实现模型的弹性伸缩与高效运维,推动AI服务向模块化、可观测、可扩展的现代软件架构演进。

#vLLM
Qwen3-8B贡献者招募:一起推动开源大模型发展

Qwen3-8B是一款80亿参数的高效开源大模型,支持32K上下文、中英文双语优化,可在消费级显卡上流畅运行。本文详解其架构设计、量化部署、推理加速及在企业知识助手、内容创作、代码生成等场景的应用,展现轻量模型的强大落地能力。

Wan2.2-T2V-A14B模型的容器化封装与Kubernetes部署实践

本文介绍如何通过Docker与Kubernetes实现Wan2.2-T2V-A14B百亿参数文本到视频模型的容器化封装与生产级部署,涵盖环境一致性、弹性伸缩、冷启动优化、资源调度及成本控制等关键技术,支撑高并发、低延迟的工业级AI视频生成应用。

Qwen-Image一键部署:Docker镜像快速启动图文生成服务

本文介绍了如何在星图GPU平台上自动化部署Qwen-Image Docker镜像,快速搭建图文生成服务。该平台简化了部署流程,用户可一键启动服务,并利用Qwen-Image强大的文本渲染能力,轻松生成包含精准文字的海报、广告图等营销设计素材。

    共 890 条
  • 1
  • 2
  • 3
  • 89
  • 请选择