Pular para o conteúdo principal

Alertas

Um alerta nasce de uma regra de monitoramento: uma condição que, quando verdadeira por tempo suficiente, abre um alerta e dispara ações.

Acesse Alertas no painel do RMM.


Começar pelos monitores prontos

A tela de Alertas traz 8 modelos que viram regra em um clique — disco, CPU, memória, máquina offline, carga e tráfego de rede. Comece por eles: os limites já vêm em valores que fazem sentido.


Anatomia de uma regra

CampoO que é
MedidaCPU %, memória %, disco %, disco mais cheio %, carga, tráfego de entrada/saída — ou offline
Operador>, >=, <, <=, ==, !=
LimiteO valor comparado
DuraçãoPor quantos segundos a condição precisa persistir antes de abrir
Severidadeinfo, warning ou critical
CooldownJanela mínima antes de a mesma regra reabrir na mesma máquina
EscopoCliente inteiro, um site, um grupo ou uma máquina específica

Duração é o campo que mais economiza barulho

Um pico de CPU de 15 segundos não é problema; CPU a 95% por 10 minutos é. Sem duração, todo pico vira alerta e o time aprende a ignorar a caixa de entrada.

Offline é a única regra baseada em ausência

As outras medidas chegam junto com os dados da máquina. Máquina caída não manda nada — então o servidor precisa procurar por ela. A verificação roda a cada minuto, e é por isso que a regra de offline é configurada em minutos sem contato, não em segundos.


Ações do alerta

AçãoO que faz
E-mailAvisa os destinatários na abertura e na resolução
WebhookEnvia o alerta a um sistema externo, com status: open ou resolved
ChamadoAbre chamado no Noxus Core e fecha quando o alerta resolve
Auto-remediaçãoDispara um script da biblioteca na máquina que alertou

Ver Integração com o Noxus Core para o fluxo de chamado.


Um alerta aberto por regra e máquina

Um disco cheio não pode virar 1.440 alertas por dia. Enquanto o alerta estiver aberto, a mesma regra não abre outro para a mesma máquina — e também não renotifica.

Quando a condição deixa de valer, o alerta fecha sozinho. Ninguém precisa passar fechando alerta resolvido.


Silenciar e reconhecer

São coisas diferentes:

AçãoOndeO que faz
Silenciar máquinaNo detalhe do dispositivoSuprime qualquer alerta daquela máquina até a data escolhida
Reconhecer alertaNo alerta abertoMarca quem assumiu. Não resolve o alerta

Silenciar é para manutenção programada — você vai derrubar o servidor e não quer acordar ninguém. Reconhecer é para dizer ao time que alguém já está cuidando; a condição continua de pé e o alerta continua aberto.

Cooldown mata o alerta que pisca

Disco parado em 89,9% com limite em 90% abre e fecha o dia inteiro. O cooldown define quanto tempo precisa passar depois da resolução antes de a regra poder reabrir — é o campo que resolve isso.