Skip to content

告警与指标分离

告警与指标分离是 aiots 告警体系的核心设计: 需要处理的问题才叫告警, 需要关注的状态叫指标。 告警通知人去处理, 指标只在界面上标个状态, 避免告警轰炸。

📖 配置教程:告警中心教程

什么时候会用到这个功能

设备点位多, 告警群一天几百条, 没人看了。 做设备监控的都进过这个怪圈: 上平台前担心出事没人知道, 上平台后温度偏高报一条、波动一下又报一条, 一周之后没人点开告警群。把"指标"级配给这种"偏离但还在范围内"的状态——只显示"偏高/偏低"标签, 不推送不入库, 告警列表恢复干净。

几百台设备, 每台都要配离线告警。 设备离线是最常见的异常, 传统做法一台台配, 几百台就是几百条重复配置。aiots 把设备上线/离线做成自动记录, 一条"状态"级规则统一通知, 不用逐台配。

值班员收到告警, 还要登录平台查是哪台设备。 告警内容支持 {deviceSn}{value}{grade} 占位符, 推送消息直接带设备编号和触发值, 值班员不用再挨个查。同一条规则反复触发, 用告警频率合并, 60 秒内只报一次。

单属性阈值覆盖不了的条件。 "温度大于 50 且湿度小于 30 才报警"这种跨属性组合, 交给场景联动配多条件(且/或)。属性告警管简单阈值, 场景联动管组合判断, 两层分工清楚。

能解决哪些问题

问题解法
告警轰炸, 响多了反而没人看指标只显示标签, 不推送不入库
几百台设备离线要逐台配置设备上下线自动记录, 统一规则通知
告警消息没上下文内容占位符带设备编号/触发值/等级
同规则反复触发刷屏告警频率合并, 60 秒内只报一次