
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
K8s 集群 3 节点:k8s-master(192.168.1.10), k8s-node1(192.168.1.11), k8s-node2(192.168.1.12),K8s 版本 v1.32.13排障场景:生产运维排障通用,已部署完整K8s集群,核心组件正常运行,业务Pod已部署,监控告警系统已配置操作系统 Rocky Linux 8.6,容器运行时 Containerd 1.7.x,网络
K8s 集群 3 节点:k8s-master(192.168.1.10), k8s-node1(192.168.1.11), k8s-node2(192.168.1.12),K8s 版本 v1.32.13监控组件:监控告警系统通用,已部署对应监控组件 Pod,Prometheus 已配置服务发现,Grafana 已对接数据源操作系统 Rocky Linux 8.6,容器运行时 Containerd
Rocky9 系列官方弃用 Docker,K8s 1.24+ 强制使用 containerd,全程永久配置、重启不失效,适配 K8s 1.24~1.33。# 添加kubernetes阿里云yum源(同时附带containerd)# 2. 修改镜像加速器(阿里云镜像仓库,解决拉取k8s镜像超时)# 3. 配置国内docker.io镜像加速(可选,加速业务镜像)# 1. cgroup驱动改为syste
环境说明:CentOS 7.9,K8s‑1.18.20;规避 Docker24 + 移除 dockershim 的 CRI 报错问题;使用稳定版本(自带 dockershim,原生兼容 k8s1.18)。故障背景:Docker26 版本过高,dockershim 被移除,kubeadm 报;包冲突、残留导致安装失败。
卡住,kill‑9杀完又自动起来,,所以杀完又复活。你目标:彻底干掉 docker26,卸载,装 docker‑19.03 给 k8s1.18 使用。
首次执行 kubeadm init 报错:6443、2379、10257、10259 全部端口占用、etcd 目录残留、静态清单文件残留。问题根源:国内无法正常访问 docker.io、calico 镜像源不稳定、阿里云旧 calico 镜像源已下线。新版 flannel 使用 ghcr.io 镜像,国内卡顿,耐心等待镜像拉取完成,最终全部容器启动成功。决策:放弃 calico,改用 flanne
Harbor 离线版 + HTTPS 证书认证。Rocky8.6 专用,解决证书不匹配问题。Kubernetes 单节点集群。Harbor 私有镜像仓库。
│TCP参数 │ conntrack │ 多队列 │ offload│。│物理层(硬件/网卡)│。# 参数说明:-t8 8线程,-c1000 1000并发连接,-d60s 持续60秒。│带宽限流 │ 访问控制 │ QoS等级 │ 流量隔离│。│万兆网卡 │ 交换机QoS │ 网卡绑定 │ 中断亲和│。│连接池优化 │ 超时配置 │ 重试策略 │ 熔断降级│。
content = f"[{severity.upper()}] {alert['annotations'].get('summary', '告警')}\n节点: {alert['labels'].get('instance', 'N/A')}\n描述: {alert['annotations'].get('description', 'N/A')}"description: "节点{{ $lab
kubectl run ping-test --image=busybox:1.36 --rm -it --restart=Never -- ping -c 4 <对端PodIP>**注意**:K8s使用的镜像必须导入到 `k8s.io` 命名空间,否则kubelet找不到镜像。│ 2. 拉取镜像│ ──── tar包 ─────►│ 2. ctr导入镜像│。│ 3. 下载二进制 │ ──── 压







