logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Terraform实战01:第一个Terraform项目——VPC + EC2

从零开始动手实操Terraform,在真实AWS环境中创建VPC、子网、Internet Gateway、安全组和EC2实例。详解资源间的依赖关系、Terraform核心命令(init/plan/apply/destroy),以及AWS网络架构中各组件如何串联。附完整代码和关键字段说明。

文章图片
#terraform#aws#devops
Terraform实战10:RDS + Secrets Manager——数据库与密钥管理

用Terraform创建RDS MySQL数据库,配合random_password生成强密码,通过Secrets Manager安全存储数据库凭证。详解数据库子网组、存储加密、安全组限制、生产环境安全最佳实践对照表。

文章图片
#terraform#数据库#云原生 +2
Terraform实战11:完整三层架构——VPC + EKS + RDS

将前面所有知识串联,用一套Terraform代码构建完整的生产级三层架构:网络层(VPC+6子网+NAT)、计算层(EKS集群)、数据层(RDS+Secrets Manager),共65个资源。重点讲解安全组链式设计实现层与层之间的精确访问控制。

文章图片
#terraform#架构#云原生 +2
Terraform实战15:多云实践——AWS + 阿里云

演示用Terraform同时管理AWS和阿里云,配置多Provider和alias实现多云多区域管理。详解AWS与阿里云资源对照表、sensitive变量、多云项目结构设计,直接对应三云DevOps的实际工作场景。

文章图片
#terraform#aws#阿里云 +1
AI全栈知识01:大模型是什么 - 从Token到生成

用最通俗的方式解释大模型的工作原理:它不是"查答案"而是"造句",逐字预测生成回答。详解Token计费、训练vs推理的区别、模型大小与GPU显存的关系、Prompt的三种角色,帮助运维工程师建立对大模型的正确认知。

文章图片
#人工智能#transformer
Kubernetes生产运维00:会部署K8s,不等于会运维K8s

会创建Deployment、Service和Ingress,只能说明会使用Kubernetes。生产运维真正考验的是面对模糊故障时,能否根据影响等级决定先止损还是先定位,再用时间线和分层证据不断缩小范围,最终形成修复、监控与复盘闭环。本文给出整套专栏路线和通用排障框架。

文章图片
#kubernetes#运维#容器 +2
AI Infra实战03:vLLM部署实战——跑通第一个大模型推理服务

在AutoDL T4 GPU上部署vLLM推理服务,使用Qwen2-1.5B模型实现OpenAI兼容API。详解模型下载、服务启动、多种API调用方式(对话/流式/角色设定),附T4环境踩坑记录(HuggingFace镜像、flash-attn兼容)。

文章图片
#人工智能#语言模型
Kubernetes生产运维02:只会get pods还不够,kubectl排障工具箱怎么组合使用

kubectl排障不是把常用命令依次执行一遍,而是根据当前问题选择最有区分度的证据。本文系统拆解get、describe、logs、events、top、JSONPath和debug的适用场景、关键字段、判断分支与风险边界,并提供一个组合排障案例和可直接使用的只读现场采集脚本。

文章图片
#kubernetes#运维#容器
Kubernetes生产运维01:告警来了先别急着重启,生产故障如何一步步缩小范围

生产告警通常只给出现象,不会直接给出根因。本文通过一次Redis偶发超时与节点TCP连接异常的真实脱敏案例,完整拆解影响判断、现场取证、范围收敛、分层检查、对照验证、受控恢复和长期治理,并提供可直接使用的首轮排障清单与证据记录模板。

文章图片
#kubernetes#运维#容器
Kubernetes生产运维03:Pod一直Pending怎么办,沿着调度器决策链系统排查

Pod显示Pending,不一定只是CPU或内存不足,也不一定还没有完成调度。本文先区分Pod未创建、等待调度与已调度但未启动,再沿着调度门控、schedulerName、资源requests、污点、亲和性、拓扑分布、PVC绑定和抢占逐层取证,提供判断表、C级生产化重建案例与可直接使用的只读采集脚本。

文章图片
#kubernetes#运维#容器
    共 17 条
  • 1
  • 2
  • 请选择