logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Ostrakon-VL-8B快速部署:基于Docker镜像的免配置多模态服务上线方案

本文介绍了如何在星图GPU平台上自动化部署Ostrakon-VL-8B多模态模型镜像,快速搭建面向零售场景的AI视觉分析服务。该方案基于预配置的Docker镜像,免除了复杂的环境配置,用户可通过简单的Web界面上传店铺图片,实现商品识别、库存盘点及合规检查等核心应用。

零基础5分钟部署Qwen3-VL:30B多模态大模型,打造飞书智能办公助手

本文介绍了如何在星图GPU平台上自动化部署‘星图平台快速搭建 Clawdbot:私有化本地 Qwen3-VL:30B 并接入飞书(上篇)’镜像,快速构建私有化多模态大模型服务;该镜像支持对产品截图、会议白板、合同扫描件等办公图片进行精准图文理解与结构化信息提取,赋能智能办公场景。

verl+PyTorch FSDP联合部署:大模型训练实战案例

本文介绍了基于星图GPU平台自动化部署verl镜像的实战方案,结合PyTorch FSDP实现高效的大模型后训练。该平台支持一键部署verl框架,适用于LLM的强化学习微调场景,显著提升训练吞吐与资源利用率,助力AI应用开发中模型迭代的自动化与规模化。

深入解析云计算与大数据技术架构及行业应用讲座PPT

与其手动操作控制台,不如用 YAML 文件描述整个 MLOps 流水线:Stages:Inputs:- S3Input:Outputs:通过 CLI 部署:从此,模型发布就像发版本一样标准可控,配合 GitOps 实现审计追踪。回头看,云计算与大数据的融合,不只是技术升级,更是一场组织能力的重构。它让我们重新思考:- 资源该如何分配?- 数据该如何治理?- 团队该如何协作?那些敢于拥抱变化的企业,

大模型Token生成速度翻倍?vLLM推理优化实战分享

本文介绍如何使用vLLM提升大模型推理效率,通过PagedAttention、连续批处理和OpenAI兼容API三大技术,显著提高GPU利用率和吞吐量,降低延迟与部署成本,适用于高并发生产环境。

#vLLM
Docker Init初始化LLama-Factory训练环境脚本模板分享

本文介绍如何通过Docker初始化脚本快速搭建LLama-Factory大模型微调环境,解决CUDA版本冲突、依赖安装慢、共享内存不足等常见问题。脚本集成国内镜像加速、权限映射与资源限制,实现从零到WebUI训练的三步部署,显著提升团队效率与实验可复现性。

Dify本地部署完整教程:Docker与Git配置指南

通过Docker和Git快速部署Dify,涵盖环境搭建、镜像加速配置、容器启动及常见问题解决,帮助用户顺利完成本地AI应用部署并访问管理界面。

LangFlow与HuggingFace集成:无缝调用开源大模型

通过LangFlow可视化编排,轻松调用HuggingFace上的开源大模型,实现无需编码的RAG流程搭建。支持拖拽式构建、实时调试与脚本导出,适合快速验证AI应用原型,提升开发效率并促进跨团队协作。

云计算厂商竞争加剧:低价抢占Anything-LLM用户市场

随着生成式AI落地加速,Anything-LLM作为开源RAG应用成为云厂商竞争焦点。通过一键部署、免费算力等策略,各大云平台正以低价抢占企业智能知识库入口,推动AI从通用能力向私有化、低成本、易用的业务集成演进。

#云计算#RAG
RTX4090赋能Qwen大模型优化工业仿真生成技巧

本文探讨了RTX4090与Qwen大模型协同优化工业仿真的技术路径,涵盖硬件适配、模型量化、推理加速及语义理解等关键环节,提出AI驱动的仿真生成新范式,并验证其在多场景下的效率提升与跨领域迁移能力。

    共 844 条
  • 1
  • 2
  • 3
  • 85
  • 请选择