logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

基于Python的猫狗识别深度学习实战项目

图像分类本质上是一个映射函数的学习过程:给定一幅二维像素矩阵 $ I \in \mathbb{R}^{H \times W \times C} $,其中 $ H $ 表示高度、$ W $ 宽度、$ C $ 为通道数(通常为3,对应RGB色彩空间),目标是输出一个类别标签 $ y \in {1, 2, …, K} $,表示该图像所属的预定义类别。对于猫狗识别任务而言,$ K = 2 $,即二分类问题

Ostrakon-VL-8B镜像免配置实践:Kubernetes Helm Chart一键部署至生产集群

本文介绍了如何在星图GPU平台上,通过Kubernetes Helm Chart实现Ostrakon-VL-8B镜像的自动化部署。该镜像是一个专为餐饮零售(FSRS)场景优化的开源多模态大模型,能够高效完成商品识别、货架合规检查等核心视觉任务,助力企业快速实现智能化升级。

零基础5分钟部署GLM-4.7-Flash:最强开源大模型开箱即用教程

本文介绍了如何在星图GPU平台上自动化部署GLM-4.7-Flash镜像,实现零门槛使用最强开源大语言模型。该平台简化了复杂的部署流程,用户可快速启动并访问Web界面,将模型应用于代码生成、文档撰写、逻辑推理等文本生成场景,轻松获得AI助手能力。

中小团队如何利用 Taotoken 统一管理多个大模型 API 调用成本

中小团队如何利用 Taotoken 统一管理多个大模型 API 调用成本 1. 多模型统一接入的痛点与解决方案 中小开发团队在同时使用多个大模型时,常面临 API 密钥分散、计费方式不统一、用量统计繁琐等问题。每个模型供应商都有独立的控制台和账单系统,团队需要为每个成员分配多个密钥,并在月末手动汇总各平台的调用数据,财务对账成本居高不下。 Taotoken 提供的多模型聚合能力,允许团队通过单一

Spark大数据分析HiChatBox实现

本文探讨联发科MT7697芯片与蓝牙5.0在智能音箱中的低功耗音频处理应用,通过硬件集成与协议优化实现远距离、低延迟、低功耗的语音交互系统,提升设备响应速度与续航能力。

vLLM能否运行在云原生环境中?容器化部署指南

本文深入解析vLLM在Kubernetes环境下的容器化部署方案,涵盖PagedAttention、连续批处理、OpenAI兼容API等核心技术,实测提升显存利用率至85%以上,吞吐量提升5-10倍,支持量化模型与自动扩缩容,助力构建高性能、低成本的云原生大模型推理平台。

#vLLM#云原生
Qwen3-32B与Spark大数据平台协同工作的架构设计

本文介绍Qwen3-32B大模型与Apache Spark大数据平台的协同架构设计,通过128K上下文支持与分布式计算结合,实现对TB级文档的高效语义分析。利用Spark进行数据分片与调度,Qwen3完成高质量推理,构建可扩展的工业级AI处理流水线,适用于金融、法律等高知识密度场景。

开源大模型推荐:Seed-Coder-8B-Base 实现智能代码补全与纠错

Seed-Coder-8B-Base是一款专为代码生成与补全设计的80亿参数开源大模型,支持多语言、长上下文输入,可在本地部署保障数据隐私。该模型基于Transformer架构,具备高代码准确率和可定制化优势,适用于企业级开发提效、新人辅助及私有化AI编程助手场景。

开源可控的大模型体验:GPT-OSS-20B的优势与应用

GPT-OSS-20B是一款开源、可本地部署的210亿参数大模型,采用稀疏激活与量化技术,可在消费级显卡运行。支持结构化输出与低资源推理,适用于医疗、金融等数据敏感领域,实现低成本、高安全的AI应用落地。

Docker安装过程中常见TensorRT镜像拉取失败解决方案

本文深入分析Docker安装中TensorRT镜像拉取失败的常见原因,包括网络超时、认证要求和版本错误,并提供有效解决方案。涵盖NGC认证配置、私有仓库搭建及企业级依赖管理策略,帮助开发者稳定获取镜像并实现AI模型高效部署。

    共 952 条
  • 1
  • 2
  • 3
  • 96
  • 请选择