Prometheus 告警怎么推到钉钉?从单群通知到跨网络 Alertmanager 实战监控系统真正有价值的时刻,不是图表看起来多完整,而是异常发生以后,负责的人能不能及时收到一条足够清楚、能够继续处理的告警。Prometheus 负责发现问题,Alertmanager 负责分组、路由和通知,但钉钉并不是它直接支持的通知目标,所以中间还需要一层 prometheus-webhook-dingtalk。我比较在意这种链路能不能一段一段验证,而不是一上来就把“生产可用、高可靠”写在标题里。告警系统最怕的不是配置多,而是链路长:任何一环没通,最后表现出来都只是“群里没消息”,所以越是这种跨组件集成