logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

从 GB 到 KB:我用 Shell 脚本把 Docker镜像瘦身到客户都不敢信

客户嫌升级包太大?我用 Shell 拆解 Docker 镜像,对比 Spring Boot jar 差异,把几个 GB 的升级包干到 KB 级。

文章图片
#docker#容器#java +2
Rootless Docker 部署 OceanBase-MySQL(4.3.3.1) 单机版踩坑与全纪录

本文详细介绍了在非root用户环境下通过RootlessDocker部署OceanBase-MySQL单机精简版的完整过程及排错指南。主要内容包括:1)RootlessDocker离线安装及存储驱动缺失、网段配置错误、进程残留等问题的解决方案;2)OceanBase部署时连接假死问题的处理,重点解决进程数限制导致的资源不足问题;3)数据清理时遇到的单文件大小限制及其规避方法。文章提供了完整的自动化

文章图片
#docker#oceanbase#容器 +2
Kubernetes 中的 GPU:其底层工作原理

1、Kubernetes通过NVIDIA驱动程序和设备插件管理GPU,而非借助cgroups或命名空间,因此无法像处理CPU或内存那样对GPU进行限流、细分或回收。2、一个正常运行的GPU节点需要四个独立层次:内核驱动程序、用户空间的CUDA、NVIDIA容器工具包,以及向kubelet声明nvidia.com/gpu资源的设备插件。3、大多数GPU Pod规范仅设置limits.nvidia.c

文章图片
#kubernetes#容器#云原生 +2
vLLM 部署 Qwen 32B:企业数据分类分级落地实战

本文详细介绍了如何利用vLLM框架高效部署Qwen2.5-32B大模型,实现企业级数据分类分级任务。主要内容包括: 关键技术解析 vLLM框架特性:支持高并发、多卡推理、量化模型和长文本处理 Qwen32B模型优势:320亿参数规模在准确率和部署成本间取得平衡 量化技术对比:AWQ和GPTQ的性能差异及适用场景 多卡部署要点:张量并行配置和NCCL通信优化 生产部署方案 硬件选型建议:根据不同场景

文章图片
#分类#人工智能#docker +2
到底了