第二章:环境规划与准备(实操详解版)【Prometheus 20260817】

📅 2026/8/19 23:54:52
第二章:环境规划与准备(实操详解版)【Prometheus 20260817】
文章目录第二章:环境规划与准备(实操详解版)2.1 监控规模评估——先算账,再动手大白话深度解析:资源估算公式实操:三种典型规模的资源估算场景 A:小规模(10 台 Linux 主机 + 50 容器)场景 B:中规模(50 台 Linux 主机 + 200 容器 + 1 套 K8s)场景 C:大规模(200+ 主机 / 1000+ Pod)实操:快速估算脚本2.2 服务器规划清单2.2.1 角色分配方案方案一:All-in-One(≤ 20 台主机,测试/小环境)方案二:分离部署(20-100 台主机,生产环境)方案三:高可用部署(100+ 台主机,核心生产)2.2.2 操作系统选择2.3 网络与端口规划2.3.1 完整端口清单2.3.2 防火墙配置实操CentOS/Rocky(firewalld)Ubuntu(ufw)iptables(通用)2.3.3 安全加固:限制源 IP云服务器安全组配置2.4 操作系统准备2.4.1 基础环境检查2.4.2 系统优化(监控中心服务器必做)1. 文件描述符限制2. 内核参数优化3. 关闭 Swap(推荐)4. 时间同步(极其重要)2.4.3 创建专用用户和目录创建运行用户目录规划2.5 Docker 环境准备(Docker 部署方式)2.5.1 Docker 安装CentOS/Rocky LinuxUbuntu2.5.2 Docker 镜像加速(国内必做)2.5.3 Docker Compose 安装(可选,推荐)2.5.4 预拉取监控镜像2.6 离线/内网环境准备大白话2.6.1 二进制包离线准备2.6.2 Docker 镜像离线导出2.6.3 内网机器导入2.6.4 RPM 依赖离线准备(CentOS/Rocky)2.7 K8s 环境前置检查2.7.1 集群信息收集2.7.2 权限确认2.7.3 网络策略检查2.7.4 存储准备(可选)2.8 部署前预检清单✅ 监控中心服务器✅ 被监控 Linux 主机✅ Docker 主机✅ Kubernetes 集群2.9 本章实操总结执行顺序关键文件速查常见踩坑预警好的,我来把第二章"环境规划与准备"做成可落地的实操手册,涵盖规模评估、资源估算、网络规划、系统调优、离线准备等全流程。第二章:环境规划与准备(实操详解版)2.1 监控规模评估——先算账,再动手大白话部署监控之前,先搞清楚三件事:要监控多少东西?(几台主机、几个容器、几个 K8s 集群)数据要存多久?(15 天还是 3 个月)抓取多频繁?(15 秒还是 30 秒)这三个数字决定了 Prometheus 需要多大的 CPU、内存和磁盘。深度解析:资源估算公式Prometheus 官方给出的经验公式:每秒采集样本数(samples/sec)= 目标数 × 每目标指标数 / 抓取间隔(秒) 磁盘占用(bytes)= 每秒样本数 × 保留天数 × 86400 × 每样本字节数每样本字节数:Prometheus TSDB 压缩后约1-2 字节/样本(取 1.5 作为估算值)。实操:三种典型规模的资源估算场景 A:小规