服务器出问题不能靠用户发现。本文教你搭一套监控告警。
架构概览
Prometheus采集指标,Grafana做可视化,Alertmanager发告警。一个docker-compose就能跑起来。
关键指标
CPU、内存、磁盘、网络是基础。加上网站响应时间、5xx错误率等业务指标。
告警规则
磁盘超过80%、CPU持续5分钟超过90%、网站不可达时发通知到微信或邮件。
服务器出问题不能靠用户发现。本文教你搭一套监控告警。
Prometheus采集指标,Grafana做可视化,Alertmanager发告警。一个docker-compose就能跑起来。
CPU、内存、磁盘、网络是基础。加上网站响应时间、5xx错误率等业务指标。
磁盘超过80%、CPU持续5分钟超过90%、网站不可达时发通知到微信或邮件。

