Мониторинг Load Average сервера
Эта задача помогает замечать перегрузку Linux-сервера по средней системной нагрузке, а не только по проценту CPU.
Для этого типа задачи требуется тариф PRO.
Поля формы
| Поле | Что означает | Что указать | Пример |
|---|---|---|---|
| Название | Имя проверки. | Укажите, для какого сервера контролируется средняя нагрузка. | Load Average production-сервера |
| Группа | Позволяет отнести задачу к проекту или разделу. | Выберите группу, если хотите держать задачи по проекту вместе. | Основной проект |
| Максимум Load Average | Порог средней нагрузки для тревоги. | Укажите значение с учётом числа ядер и обычной нагрузки сервера. | 4 |
| Таймаут | Допустимая задержка прихода данных от скрипта. | Оставьте запас на штатное выполнение скрипта. | 5 минут |
| Интервал | Как часто будет приходить значение нагрузки. | Выберите частоту, которая соответствует запуску скрипта. | 1 минута |
| Каналы уведомлений | Куда отправлять сообщения о проблеме и восстановлении. | Отметьте каналы, в которых вы реально читаете уведомления. | Telegram и email |
| Отчёты | Периодические сводки по задаче. | Включите, если хотите получать обзор без ручного входа в панель. | Еженедельный отчёт |
Когда придёт тревога
- Если значение Load Average превысит указанный порог.
- Если серверный скрипт не пришлёт данные вовремя.
Настройка уведомлений
Для каждого канала уведомлений в задаче можно задать дополнительные параметры. Они действуют только для DOWN-событий.
| Параметр | Что делает |
|---|---|
| Включён | Разрешает или запрещает отправку уведомлений по этому каналу для данной задачи. |
| Отложить на PRO | Задерживает первое уведомление о DOWN на выбранное время (до 12 часов). Удобно, чтобы не получать оповещения о кратковременных сбоях. |
| Повторять через PRO | Периодически повторяет уведомление, пока задача остаётся в статусе DOWN (до 1 часа между повторами). Подходит, когда важно не пропустить затяжной сбой. |
Параметры «Отложить» и «Повторять» не влияют на UP-события и уведомления о восстановлении.