Prometheus + Grafana 监控平台部署

由于在该环境中Kubernetes的版本是 1.20.2,我们不使用最新版 kube-prometheus-stack,而采用兼容 1.20 的 Prometheus Operator + Grafana 部署方案,避免兼容性问题。对于 Kubernetes 1.20,官方兼容矩阵建议使用较早的 kube-prometheus release(如 release-0.8)。 15.1 准备环境 15.1.1 确认节点全部正常 在 ECS 上执行: kubectl get nodes 应该类似: NAME STATUS ROLES ecs-prod Ready control-plane k8s-node1 Ready k8s-node2 Ready 如果不是全部 Ready,就先不要继续。 kubectl get pods -A 确保: CoreDNS Calico Ingress 全部 Running。 15.1.2 确认资源充足 执行: kubectl top nodes 如果没有安装 metrics-server,不要紧,会提示: Metrics API not available 后续我们也可以补装。 15.1.3 创建监控命名空间 kubectl create namespace monitoring 查看: kubectl get ns 应该出现: monitoring 15.2 拉取node-exporter:v1.3.1镜像并推送Harbor 15.2.1 devops机器拉取镜像 你的 devops: ...

July 25, 2026 · 6 min · HybridBlog