logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

第一台云服务器选购

本文对比了腾讯云轻量应用服务器与华为云耀云服务器在个人建站、开发环境和爬虫代理三大场景下的表现。关键发现: 价格陷阱:首年低价≠长期划算,续费价格和流量包更关键 场景适配: 新手建站首选腾讯云(镜像丰富) 华为生态用户优选耀云(流量包更大) 开发环境内存≥4GB更佳 性能误区:2核2G配置实际体验受地域/磁盘/软件影响显著 避坑要点:需重点关注备案政策、月流量限额及业务合规性 建议决策路径:个人用

#腾讯云#华为#支持向量机 +1
Kubernetes 生产集群的资源治理:从 requests 到 HPA 的可执行清单

实践建议:先给线上服务补齐 requests、readinessProbe、滚动发布策略和基础 HPA,再按监控数据调整数值。发布后看三类指标:Pod 是否频繁重启、CPU 是否长期 throttle、内存工作集是否贴近 limit。资源问题要有固定排查顺序:先看事件,再看重启,再看节点,再看应用指标。事件会直接提示调度失败、镜像拉取失败、探针失败、OOMKilled、驱逐等信息。资源治理的目标是

#kubernetes#容器#云原生 +4
Docker 镜像瘦身和构建缓存:让发布更快也更可控

环境变量、数据库密码、Token 应该由运行环境注入,例如 Kubernetes Secret、Docker Compose env_file 或云厂商密钥服务。镜像应该是同一个制品在不同环境运行,而不是为测试、预发、生产分别构建三份带不同配置的镜像。它会拉长 CI 构建时间、占用镜像仓库存储、拖慢节点拉取速度,还会扩大漏洞扫描范围。国内很多团队的发布慢,表面看是流水线慢,实际是基础镜像随意、依赖

#docker#缓存#容器 +3
Docker多阶段构建优化镜像体积

很多 Docker 镜像变大的原因不是业务代码复杂,而是把构建环境、缓存、测试工具和运行时依赖全部塞进了最终镜像。一个 Node、Go 或 Java 项目在构建阶段需要编译器、包管理器和临时文件,但线上运行往往只需要二进制、静态资源或少量运行库。镜像越大,拉取越慢,漏洞扫描噪声越多,回滚和扩容也越慢。团队应维护一组经过扫描和验证的基础镜像,统一时区、证书、用户权限和安全补丁,而不是让每个项目自由选

#docker#容器#运维 +4
Kubernetes Service与Ingress流量管理

在生产落地时,建议为每个服务准备固定的排障清单:域名解析、Ingress 规则、Controller 日志、Service endpoints、Pod readiness、应用日志和后端依赖。Service 与 Ingress 的价值,正是把动态 Pod 背后的访问关系变成稳定、可审计的声明。当出现 502 或 504 时,要沿着链路看:DNS 是否到入口负载均衡,Ingress Controll

#kubernetes#容器#云原生 +3
Docker Compose编排微服务开发环境

平时只启动数据库和当前服务,联调时再启动完整链路,避免本地机器被无关容器占满。Compose 文件越接近真实依赖,越能提前暴露配置、网络和启动顺序问题,但它仍应保持轻量,不能演变成一套难维护的小型生产集群。若多个项目同时运行,可以通过项目名隔离,避免容器名和端口冲突。团队还可以准备一份最小数据集,用于初始化本地数据库,让接口调试和自动化测试有稳定输入。把本地环境编排好之后,单元测试、集成测试和 C

#docker#微服务#容器 +3
云原生CI/CD流水线设计与GitOps实践

策略可以通过代码扫描、镜像签名、部署审批和集群准入控制落地,但规则必须透明,不能只靠人工口头提醒。云原生 CI/CD 的成熟标志不是工具多,而是变更小、验证快、发布可审计、失败能快速回到已知稳定状态。它要保证从提交、构建、测试、扫描、制品、部署到回滚都有记录。每个线上版本都应该能回答:来自哪个 commit,经过哪些检查,使用哪个镜像,谁批准,部署到哪个环境。高风险环境仍然需要审批、灰度和指标观察

#云原生#ci/cd#linux +2
本地大模型部署实战(5):vLLM 高吞吐推理服务部署

前四篇解决单机可用性,本篇转向多人并发。vLLM 通过连续批处理与 PagedAttention 提升吞吐,并直接提供 OpenAI 兼容服务。

#spring#java#vLLM
本地大模型部署实战(4):用 Open WebUI 搭本地聊天界面

上一篇掌握了底层推理参数,本篇把 Ollama 或 OpenAI 兼容后端接到 Open WebUI,补齐会话、模型选择和用户入口。

#spring#java#后端
本地大模型部署实战(7):本地模型接入 OpenAI 兼容 API

上一篇选定了可接受的量化版本,本篇用统一的 OpenAI 兼容协议隔离应用与后端,让 Ollama、llama.cpp 或 vLLM 可以替换而不改业务代码。

#spring#前端#java
    共 63 条
  • 1
  • 2
  • 3
  • 7
  • 请选择