Перейти к содержимому
Правило корреляции

Servers: Высокая загрузка CPU

Правило формирует инцидент при устойчивой средней загрузке CPU сервера выше 85% за последние 10 минут по данным метрик серверов.

Правило мониторинга из модуля Servers. Формирует инцидент при устойчивой высокой загрузке процессора сервера — сигнал деградации сервиса или нехватки ресурсов.

Как работает

  • Источник: метрики серверов в индексах srv_metrics* (event.dataset = system.cpu).
  • Логика: загрузка CPU усредняется по минутным интервалам; инцидент создаётся, когда средняя загрузка за 10 минут ≥ 85%. Дополнительно фиксируется среднее iowait — чтобы отличить нехватку CPU от ожидания дискового ввода-вывода.
  • Расписание: ежечасно (0 * * * *); троттлинг инцидентов — 15 минут.

В карточке инцидента: хост, средняя загрузка CPU и iowait за окно.

Требования

  • Smart Monitor: >=6.1
  • Источники данных: метрики серверов в srv_metrics* — конфигурация сбора servers_metrics.
  • Справочники не требуются.

Установка

  1. Загрузите архив srv_incident_high_cpu-<версия>.zip в меню «Управление контентом» и установите задачу.
  2. Включите задачу в планировщике: она устанавливается выключенной.
  3. Порог (85%) и окно усреднения меняются в тексте запроса под вашу инфраструктуру.

Поток данных

Конфигурация сбора
servers_metrics
Данные
srv_metrics*
Правило корреляции
Servers: Высокая загрузка CPU
Разработчик
VolgaBlob
Категория
ИТ-мониторинг · Инфраструктура и серверы
Тип
Правило корреляции
Задание Планировщика задач с активными действиями
Стоимость
Бесплатно
Лицензия
Apache 2.0
Связанные модули