Alertas
Um alerta nasce de uma regra de monitoramento: uma condição que, quando verdadeira por tempo suficiente, abre um alerta e dispara ações.
Acesse Alertas no painel do RMM. A tela tem duas metades, em abas:
| Aba | Responde |
|---|---|
| Fila | O que fazer agora |
| Monitores | O que você quer ser avisado |
Começar pelos monitores prontos
A tela de Alertas traz 8 modelos que viram regra em um clique — disco, CPU, memória, máquina offline, carga e tráfego de rede. Comece por eles: os limites já vêm em valores que fazem sentido.
Anatomia de uma regra
| Campo | O que é |
|---|---|
| Medida | CPU %, memória %, disco %, disco mais cheio %, carga, tráfego de entrada/saída — ou offline |
| Operador | >, >=, <, <=, ==, != |
| Limite | O valor comparado |
| Duração | Por quantos segundos a condição precisa persistir antes de abrir |
| Severidade | info, warning ou critical |
| Cooldown | Janela mínima antes de a mesma regra reabrir na mesma máquina |
| Escopo | Cliente inteiro, um site, um grupo ou uma máquina específica |
Duração é o campo que mais economiza barulho
Um pico de CPU de 15 segundos não é problema; CPU a 95% por 10 minutos é. Sem duração, todo pico vira alerta e o time aprende a ignorar a caixa de entrada.
Offline é a única regra baseada em ausência
As outras medidas chegam junto com os dados da máquina. Máquina caída não manda nada — então o servidor precisa procurar por ela. A verificação roda a cada minuto, e é por isso que a regra de offline é configurada em minutos sem contato, não em segundos.
Ações do alerta
| Ação | O que faz |
|---|---|
| Avisa os destinatários na abertura e na resolução | |
| Webhook | Envia o alerta a um sistema externo, com status: open ou resolved |
| Chamado | Abre chamado no Noxus Core e o leva a Resolvido quando o alerta normaliza |
| Auto-remediação | Dispara um script da biblioteca na máquina que alertou |
Ver Integração com o Noxus Core para o fluxo de chamado.
Chamado só a partir da Nª ocorrência
Com Abrir ticket no PSA marcado, a regra mostra mais uma linha: "A partir da [N]ª ocorrência em [janela]".
| Configuração | Quando o chamado abre |
|---|---|
| 1ª (padrão) | No primeiro disparo, como sempre foi |
| 3ª em 1 h | Só quando a regra disparar 3 vezes na mesma máquina dentro de 1 hora |
O alerta é registrado, aparece na fila e avisa por e-mail e webhook toda vez — só o chamado espera. Depois da Nª, as repetições caem no mesmo chamado.
Os monitores prontos Agente offline e Rajada de login falho já vêm com 3ª ocorrência em 1 h e Não repetir por: imediato: são os dois que mais piscam.
"Não repetir por 1 h" faz a regra disparar no máximo uma vez por hora — então "3ª ocorrência em 1 h" nunca chegaria. A tela avisa, e o RMM recusa salvar essa combinação. Diminua o intervalo ou aumente a janela.
Um alerta aberto por regra e máquina
Um disco cheio não pode virar 1.440 alertas por dia. Enquanto o alerta estiver aberto, a mesma regra não abre outro para a mesma máquina — e também não renotifica.
Quando a condição deixa de valer, o alerta fecha sozinho. Ninguém precisa passar fechando alerta resolvido.
Silenciar e reconhecer
São coisas diferentes:
| Ação | Onde | O que faz |
|---|---|---|
| Silenciar máquina | No detalhe do dispositivo | Suprime qualquer alerta daquela máquina até a data escolhida |
| Reconhecer alerta | No alerta aberto | Marca quem assumiu. Não resolve o alerta |
Silenciar é para manutenção programada — você vai derrubar o servidor e não quer acordar ninguém. Reconhecer é para dizer ao time que alguém já está cuidando; a condição continua de pé e o alerta continua aberto.
A fila tem quatro visões
Como reconhecer não fecha nada, o alerta reconhecido precisa sair da frente de quem está procurando trabalho — senão a fila nunca esvazia.
| Visão | O que mostra |
|---|---|
| Novos | Aberto e sem reconhecimento — é o que espera alguém, e é onde a tela abre |
| Reconhecidos | Aberto, com alguém já cuidando |
| Resolvidos | Já fechou sozinho |
| Todos | Tudo, sem recorte |
Reconhecer um alerta tira ele de Novos na hora e move para Reconhecidos. O contador ao lado de "Alertas" no menu lateral conta apenas os Novos: ele existe para dizer que há trabalho esperando, então zera quando o time assume tudo — mesmo que a condição continue de pé.
O número de Alertas abertos no Dashboard é outra conta, de propósito: lá entram os reconhecidos também, porque a pergunta é o tamanho do problema, não a fila de trabalho.
Cada visão vive no endereço da página, então um recorte pode ser colado no chat e abre no mesmo lugar para quem receber.
Disco parado em 89,9% com limite em 90% abre e fecha o dia inteiro. O cooldown define quanto tempo precisa passar depois da resolução antes de a regra poder reabrir — é o campo que resolve isso.