Monitoramento de Load Average do servidor
Esta tarefa ajuda a detectar sobrecarga no servidor Linux pela carga média do sistema, e não apenas pela porcentagem de CPU.
Para este tipo de tarefa é necessário o plano PRO.
Campos do formulário
| Campo | O que significa | O que indicar | Exemplo |
|---|---|---|---|
| Nome | Nome da verificação. | Indique para qual servidor está sendo monitorada a carga média. | Load Average do servidor de produção |
| Grupo | Permite atribuir a tarefa a um projeto ou seção. | Selecione o grupo se quiser manter as tarefas do projeto juntas. | Projeto principal |
| Máximo Load Average | Limite de carga média para alarme. | Indique o valor considerando o número de núcleos e a carga normal do servidor. | 4 |
| Timeout | Atraso aceitável para chegada de dados do script. | Deixe uma margem para a execução normal do script. | 5 minutos |
| Intervalo | Com que frequência o valor de carga será recebido. | Escolha a frequência que corresponde à execução do script. | 1 minuto |
| Canais de notificação | Para onde enviar mensagens sobre problemas e recuperação. | Marque os canais onde você realmente lê as notificações. | Telegram e email |
| Relatórios | Resumos periódicos da tarefa. | Ative se quiser receber um overview sem entrar manualmente no painel. | Relatório semanal |
Quando o alarme será disparado
- Se o valor do Load Average exceder o limite indicado.
- Se o script do servidor não enviar os dados a tempo.
Configuração de notificações
Para cada canal de notificação na tarefa, é possível definir parâmetros adicionais. Eles valem apenas para eventos DOWN.
| Parâmetro | O que faz |
|---|---|
| Ativado | Permite ou proíbe o envio de notificações por este canal para esta tarefa. |
| Atrasar por PRO | Atrasar a primeira notificação de DOWN pelo tempo selecionado (até 12 horas). Útil para não receber alertas sobre falhas curtas. |
| Repetir a cada PRO | Repete periodicamente a notificação enquanto a tarefa permanecer em status DOWN (até 1 hora entre repetições). Ideal quando é importante não perder uma falha prolongada. |
Os parâmetros «Atrasar» e «Repetir» não afetam eventos UP e notificações de recuperação.