Windows Server 服务器监控部署文档(Prometheus + Grafana)

发布时间:2026/10/11 5:36:57
Windows Server 服务器监控部署文档(Prometheus + Grafana) Windows Server 服务器监控部署文档Prometheus Grafana目标采集几十台 Windows Server 虚拟机的 IP、CPU 使用率、内存使用率、磁盘剩余空间通过 Grafana 可视化大屏实时展示。架构每台 Windows 虚拟机部署 windows_exporter采集 Agent监听 9182→ 监控服务器部署 Prometheus 定时拉取指标 → Grafana 接入 Prometheus 并导入现成大屏模板。采集间隔全局可配置 1 分钟或 5 分钟只需改 Prometheus 配置无需改动每台机器的 Agent。方案概述与端口清单本方案使用成熟开源组件无需自行开发采集 EXEwindows_exporter开源 Windows 采集程序MSI 安装包安装后自动注册为系统服务、开机自启暴露 CPU、内存、磁盘、网卡、主机信息等指标。Prometheus时序数据库定时pull 模式从所有 windows_exporter 拉取指标本地存储。Grafana可视化大屏内置 Windows 监控仪表盘模板导入即可展示所有主机总览与趋势。组件默认端口放行说明windows_exporterTCP 9182仅允许监控服务器 IP 访问各虚拟机的 9182PrometheusTCP 9090本机/运维管理端访问GrafanaTCP 3000大屏浏览器访问此端口前置准备准备一台监控服务器低配虚拟机即可建议 2 核 4G、磁盘 50G用于部署 Prometheus Grafana。确认监控服务器与所有被监控 Windows 虚拟机内网互通虚拟机防火墙放行 9182 端口。所有 Windows 虚拟机的操作需具备管理员权限。第一步所有 Windows 虚拟机安装 windows_exporter对每台被监控的 Windows Server 执行以下操作。下载安装包官方下载地址https://github.com/prometheus-community/windows_exporter/releases选择稳定版windows_exporter-0.30.4-amd64.msi。安装方式推荐静默批量安装以管理员身份打开 PowerShell执行静默安装开启所需采集项并自动放行防火墙msiexec/iwindows_exporter-0.30.4-amd64.msi/qn ENABLED_COLLECTORScpu,memory,logical_disk,net,os,systemADDLOCALFirewallException/qn静默无窗口安装。ENABLED_COLLECTORS开启 CPU、内存、逻辑磁盘、网卡、系统信息采集。ADDLOCALFirewallException自动添加防火墙放行 9182 端口。单台测试也可双击 MSI 图形化安装采集器勾选 cpu、memory、logical_disk、net、os、system 即可。验证安装打开服务管理器services.msc找到windows_exporter状态应为“正在运行”、启动类型“自动”。本机浏览器访问http://本机IP:9182/metrics页面出现大量文本指标即采集成功。在监控服务器上访问http://虚拟机IP:9182/metrics能打开即网络通畅不通请检查虚拟机防火墙。第二步部署 Prometheus下载与解压官网https://prometheus.io/download/下载 Windows 版本prometheus-xxx.windows-amd64.zip解压到例如D:\prometheus。修改配置文件 prometheus.yml打开D:\prometheus\prometheus.yml替换为以下内容注意 YAML 用空格缩进不能用 Tabglobal:scrape_interval:1m# 采集间隔1 分钟可改为 5m 表示 5 分钟evaluation_interval:1mscrape_configs:-job_name:windows-serversstatic_configs:-targets:# 在此填写所有 Windows 虚拟机 IP:9182一行一台-192.168.1.10:9182-192.168.1.11:9182-192.168.1.12:9182# 新增机器只需在此追加一行后续新增 Windows 虚拟机装好 windows_exporter 后在 targets 中追加一行 IP:9182重启 Prometheus 即自动接入大屏。启动 Prometheuscd D:\prometheus prometheus.exe --config.fileprometheus.yml --storage.tsdb.retention.time30d--storage.tsdb.retention.time30d表示监控数据保留 30 天防止磁盘持续膨胀可按需改为 7d 或 90d。验证浏览器打开http://监控服务器IP:9090。进入 Status → Targets所有 windows 主机状态为UP即采集正常红色 DOWN 表示网络不通或 exporter 未启动。可选使用 nssm 工具将 prometheus 注册为 Windows 服务实现开机自启无需一直挂着 cmd 窗口。第三步部署 Grafana下载安装官网https://grafana.com/grafana/download下载 Windows 版本 MSI 双击安装自动注册为系统服务默认端口 3000。登录浏览器访问http://监控服务器IP:3000默认账号密码admin / admin首次登录强制修改密码。添加 Prometheus 数据源左侧菜单 Connections → Data sources → Add data source选择Prometheus。URL 填写http://127.0.0.1:9090。拉到最下方点击Save test提示成功即连通。导入现成 Windows 大屏模板内网环境说明服务器无法访问 grafana.com不能用模板 ID 在线拉取。请使用文档下方附件提供的两份 dashboard JSON 文件通过「Upload JSON file」方式手动导入。把文档下方附件中的 dashboard JSON 文件下载到本机再拷贝/上传到内网 Grafana 所在机器。在 Grafana 左侧菜单 Dashboards → New → Import或 Dashboards → Browse → 右上角 New → Import。不要在「Import via grafana.com」填写模板 ID内网连不上会报错改点Upload JSON file选择下载的 .json 文件。在 Import 页面的 Prometheus 数据源下拉中选择你在 Grafana 里已配置好的本地 Prometheus两个模板都使用数据源变量导入时才绑定不写死外网 UID。点击 Import打开仪表盘即可看到主机清单与 IP、CPU 使用率、内存占用、各磁盘剩余容量与百分比、网络流量支持全屏投屏与阈值变色如磁盘低于 20% 自动标红。两份模板二选一即可JSON 文件语言说明dash_15794.json英文Grafana 官方 windows_exporter 经典模板Uptime、CPU、Memory、磁盘概览面板稳定通用。dash_24077.json中文中文化大屏带主机下拉筛选$show_hostname按 JOB 分组展示各主机 CPU/内存/网卡推荐用于投屏可视化大屏。常用指标 PromQL自定义面板用指标PromQLCPU 使用率100 - (avg by (instance) (irate(windows_cpu_time_total{modeidle}[2m])) * 100)内存使用率100 - (windows_memory_available_bytes / windows_os_physical_memory_total_bytes * 100)磁盘剩余空间GBwindows_logical_disk_free_bytes / 1024 / 1024 / 1024磁盘剩余百分比100 * windows_logical_disk_free_bytes / windows_logical_disk_size_bytes主机 IP直接使用 instance 字段格式为 ip:9182提取 IP 展示到表格。可选监控数据同步到达梦数据库Prometheus 原生时序库适合大屏查询。若业务要求把原始监控数据落到达梦两种方案方案 APrometheus Remote Write 中间转发通过 prometheus-sql 等中转组件定时将指标 INSERT 写入达梦。参考建表 SQLCREATETABLEMONITOR_HOST_METRICS(IDBIGINTIDENTITY(1,1)PRIMARYKEY,HOST_IPVARCHAR(50),CPU_USAGEDECIMAL(5,2),MEM_USAGEDECIMAL(5,2),DISK_FREE_GBDECIMAL(10,2),COLLECT_TIMEDATETIME);方案 B定时脚本读取 Prometheus API 写入达梦编写简单 Python 脚本每分钟调用 Prometheus API 查询指标批量插入达梦简单可控几十台机器压力很小。达梦存储时序监控数据必须配置数据老化策略如只保留 30 天明细定期归档/删除旧数据否则表会无限膨胀、查询变慢。可选告警配置Grafana 内置告警可配置例如CPU 使用率 80% 持续 5 分钟触发告警磁盘剩余空间小于 10GB 告警主机离线监控不到该目标告警。支持推送钉钉、企业微信或邮件。运维排障清单现象排查方向Prometheus Targets 显示 DOWN检查 windows_exporter 服务是否运行检查虚拟机防火墙 9182 是否放行监控服务器 ping 虚拟机 IP 确认网络连通。Grafana 图表无数据确认数据源连通核对 PromQL 指标名称是否与 exporter 版本匹配。Prometheus 服务器磁盘占用过大调小 --storage.tsdb.retention.time缩短数据保留时间。新增 Windows 虚拟机安装 windows_exporter在 prometheus.yml 的 targets 增加一行 IP:9182重启 Prometheus。说明Prometheus 默认是拉取模式主动连接每台 Windows 的 9182内网环境完全适用若虚拟机处于隔离网段无法被主动连接需改用 push 模式配合 pushgateway。[Grafana大屏模板_windows_exporter_15794.json][Grafana大屏模板_中文主机总览_24077.json]

关于本文作者

来自尧图内容编辑团队

尧图内容编辑团队 内容团队

尧图内容编辑团队

本文由尧图网络内容编辑团队执笔。团队由资深项目经理、前端工程师与设计师组成,所有内容均来自亲手交付的真实项目,先讲清问题、再给出可落地的解法。尧图深耕北京网站建设十年,服务过京华建材集团、智造科技等各行业客户,把一线经验沉淀为可复用的行业观察。

  • 十年建站经验,覆盖建材、制造、服务、文创等
  • 项目经理把关选题与事实准确性
  • 工程师与设计师联合撰写专业细节
  • 统一编辑规范,保证文风与排版一致
  • 每月复盘转化数据,迭代选题方向

延伸阅读

相关资讯与近期热门内容

深度阅读推荐

建站决策前值得细读的三篇

网站改版的5个关键决策
2024-08-12

网站改版的5个关键决策

什么时候该改版、改到什么程度、如何避免流量掉光,京华建材集团改版复盘给出答案。

获取专属建站方案

看完文章,把您的行业与预算告诉我们,免费获取一份量身定制的官网建设方案与报价。

立即免费咨询