Правило мониторинга из модуля Servers. Формирует инцидент при устойчивой высокой загрузке процессора сервера — сигнал деградации сервиса или нехватки ресурсов.
Как работает
- Источник: метрики серверов в индексах
srv_metrics* (event.dataset = system.cpu). - Логика: загрузка CPU усредняется по минутным интервалам; инцидент создаётся, когда средняя загрузка за 10 минут ≥ 85%. Дополнительно фиксируется среднее iowait — чтобы отличить нехватку CPU от ожидания дискового ввода-вывода.
- Расписание: ежечасно (
0 * * * *); троттлинг инцидентов — 15 минут.
В карточке инцидента: хост, средняя загрузка CPU и iowait за окно.