Prometheus 结合 cpolar 实现远程监控告警
Prometheus、node_exporter、Alertmanager 这套组合是中小团队和个人运维的实用工具。Prometheus 能精准采集 CPU、内存等服务器核心指标,node_exporter 轻量化完成数据收集,Alertmanager 则能按规则分类推送告警。三者适配性强、开源免费,无需高额成本就能实现 7x24 小时服务器监控。
仅依靠局域网访问监控系统的弊端十分明显,比如外出时发现服务器异常,无法远程查看监控数据。而将这套监控工具与 cpolar 结合后,无需申请公网 IP、无需配置路由器端口映射,就能把监控系统暴露到公网,彻底打破了局域网的限制。
1. 在 CentOS 7 上安装 Alertmanager
在安装 alertmanager 前需要安装 node_exporter 和 prometheus。
去官网下载安装文件:https://prometheus.io/download/
找到 linux 版,下载并解压:
tar -vxzf alertmanager-0.28.1.linux-amd64.tar.gz
创建 alertmanager 的目录:
mkdir -p /app/alertmanager
cd /app/alertmanager
手动上传下载好的 alertmanager 文件并解压,改名方便记忆:
mv alertmanager-0.28.1.linux-amd64 alertmanager
将 Alertmanager 配置为系统服务:
cd /usr/lib/systemd/system
vim alertmanager.service
写入以下内容:
[Unit]
Description=https://prometheus.io
[Service]
Restart=on-failure
ExecStart=/app/alertmanager/alertmanager --config.file=/app/alertmanager/alertmanager.yml
[Install]
WantedBy=multi-user.target
加载 systemd 文件,启动 alertmanager 服务,并设置开机启动:
systemctl daemon-reload
systemctl start alertmanager.service
systemctl enable alertmanager.service
启动成功后,访问 Alertmanager,ip+9093,默认端口为 9093。
2. 安装 cpolar 实现随时随地开发
cpolar 可以将你本地电脑中的服务映射到公网。即使你在家里或外出时,也可以通过公网地址连接回本地运行的开发环境。
使用一键脚本安装命令:
sudo curl https://get.cpolar.sh | sh
安装完成后,执行下方命令查看 cpolar 服务状态:
sudo systemctl status cpolar
在浏览器上输入虚拟机主机 IP 加 9200 端口即访问 Cpolar 管理界面,使用 Cpolar 官网注册的账号登录。
3. 配置公网地址
登录 cpolar web UI 管理界面后,点击左侧仪表盘的隧道管理——创建隧道:
- 隧道名称:可自定义,本例使用了 alertmanager
- 协议:http
- 本地地址:9093
- 域名类型:随机域名
- 地区:选择 China Top
创建成功后,打开左侧在线隧道列表,可以看到刚刚通过创建隧道生成了公网地址,接下来就可以在其他电脑或者移动端设备上使用地址访问。
4. 在 Prometheus 上配置 Alertmanager
进入 prometheus 的配置文件,加入 alertmanager 告警规则:
vi /app/prometheus/prometheus.yml
加入以下内容:
alerting:
alertmanagers:
- static_configs:
- targets: ["<cpolar-public-domain>"]
这一步配置的作用是:告诉 Prometheus,当监控规则触发告警时,应该把告警信息发送到哪个 Alertmanager 服务进行处理。
重新启动 prometheus:
systemctl restart prometheus
5. 利用 Alertmanager 来配置 node_exporter 告警
我们先改写 prometheus 的配置文件,改以下内容:
vi /app/prometheus/prometheus.yml
进入到 prometheus 配置目录下,写一个配置文件 1.yml:
groups:
- name: node-alerts
rules:
- alert: node_exporter 实例宕机
expr: up{job="node_exporter",instance="localhost:9100"}==0
for: 15s
labels:
severity: critical
annotations:
summary: "实例 {{ $labels.instance }} 已停止运行超过 15 秒!"
description: "作业 {{ $labels.job }} 的实例 {{ $labels.instance }} 无法抓取。"
- name: prometheus
rules:
- alert: 实例宕机
expr: up{job="prometheus"}==0
for: 15s
labels:
severity: critical
annotations:
summary: "实例 {{ $labels.instance }} 已停止运行超过 15 秒!"
description: "作业 {{ $labels.job }} 的实例 {{ $labels.instance }} 无法抓取。"
重启 prometheus:
systemctl restart prometheus
验证一下,关闭 node_exporter,观察是否告警:
systemctl stop node_exporter
打开 alertmanager 网页,查看告警是否显示成功。
6. 使用 Alertmanager 发送服务器告警至邮箱
QQ 邮箱默认不允许外部应用直接使用密码登录 SMTP 服务器,因此你需要获取一个授权码:
- 登录 QQ 邮箱,进入设置 -> 账户。
- 找到 SMTP/IMAP/POP3/Exchange 服务,开启 SMTP 服务。
- 开启后,会提示你获取一个授权码。
接下来,进入 alertmanager 安装目录,修改 alertmanager 配置文件 alertmanager.yml:
vi /app/alertmanager/alertmanager/alertmanager.yml
添加以下内容来配置告警规则:
global:
resolve_timeout: 5m
smtp_from: '[email protected]'
smtp_smarthost: 'smtp.qq.com:465'
smtp_auth_username: '[email protected]'
smtp_auth_password: 'your-smtp-auth-code'
smtp_require_tls: false
smtp_hello: 'qq.com'
route:
group_by: ['alertname']
group_wait: 5s
group_interval: 5s
repeat_interval: 5m
receiver: 'email'
receivers:
- name: 'email'
email_configs:
- to: '[email protected]'
send_resolved: true
这样有告警消息就可以发送到邮箱啦!
我们来验证一下,配置有没有问题:
./alertmanager --config.file=alertmanager.yml --log.level=debug
手动运行测试,没报错即正确!
重启 alertmanager:
systemctl restart alertmanager
systemctl status alertmanager
登录邮箱查看,确认是否收到邮件。
7. 保留固定公网地址
使用 cpolar 为其配置二级子域名,该地址为固定地址,不会随机变化。
点击左侧的预留,选择保留二级子域名,地区选择 China Top,然后设置一个二级子域名名称,填写备注信息,点击保留。
登录 cpolar web UI 管理界面,点击左侧仪表盘的隧道管理——隧道列表,找到所要配置的隧道 alertmanager,点击右侧的编辑。
修改隧道信息,将保留成功的二级子域名配置到隧道中:
- 域名类型:选择二级子域名
- Sub Domain:填写保留成功的二级子域名
- 地区:China Top
点击更新。
更新完成后,打开在线隧道列表,此时可以看到随机的公网地址已经发生变化,地址名称也变成了保留和固定的二级子域名名称。
最后,我们使用固定的公网地址在任意设备的浏览器中访问,可以看到成功访问本地部署的 alertmanager 页面。
总结
Prometheus+node_exporter+Alertmanager 构建的监控告警体系,能切实解决个人和中小团队服务器无人实时值守的问题。而 cpolar 的内网穿透能力,让这套体系从局域网专属变成了真正可移动、可协作的运维工具。无论是个人管理博客服务器,还是小团队维护办公服务器,都能通过这套组合实现低成本、高效率的服务器监控,无需复杂的网络配置,就能让服务器的异常告警及时触达。


