Skip to main content
Scopri nel momento stesso in cui qualcosa supera i tuoi limiti, sul canale che il tuo team già monitora, invece di venire a conoscenza dal cliente. Imposta una regola una volta e Failproof AI Observability la controlla secondo una pianificazione, poi ti avvisa via email, Slack, webhook o direttamente nella dashboard. La pagina Avvisi: una griglia di schede di regole di avviso, ognuna che mostra il suo trigger, la finestra di valutazione, i canali e un badge di gravità info, warning o critical Ogni regola di avviso a colpo d’occhio: cosa monitora, con quale frequenza, dove avvisa e quanto è urgente.

Vieni a conoscenza dei problemi prima dei tuoi utenti

Smetti di aggiornare una dashboard sperando di cogliere una regressione. Imposta un avviso ogni volta che c’è un segnale che vorresti conoscere anche quando nessuno sta guardando, e fallo arrivare dove sei già:
  • Email, a chiunque debba saperlo.
  • Slack, un messaggio ricco con un pulsante che ti porta direttamente all’incidente.
  • Webhook, un POST JSON per PagerDuty, Opsgenie o il tuo endpoint, con una firma opzionale in modo che il destinatario possa fidarsi.
  • In-dashboard, silenzioso per design, per quando stai mettendo a punto una regola e non vuoi avvisare ancora nessuno.
Allega qualsiasi combinazione a una singola regola, e la sua gravità (info, warning o critical) viene mantenuta in modo che gli urgenti sembrino urgenti.

Costruisci la regola in un form, non in JSON

Descrivi cosa significa “rotto” in un form, e Failproof AI Observability scrive la regola sottostante per te. La spec JSON è semplicemente ciò che quel form produce dietro le quinte, quindi puoi leggerla per capire una regola ma raramente la digiti. Il form per il nuovo avviso: nome e descrizione, un toggle abilitato e un picker di trigger che offre soglia di metrica, SQL personalizzato, punteggio di valutazione, valutazione composta e condizioni per evento Scegli un trigger e il form mostra i campi giusti; Salva scrive la regola. Il percorso semplice è veloce: nominalo, scegli un trigger (cosa monitorare), imposta la soglia e la finestra (quanto grave, per quanto tempo), allega almeno un canale, quindi Salva e premi Test per attivare una notifica sintetica e confermare che ogni destinazione è collegata. Dietro le quinte questo produce una spec piccola come:
Non sei limitato a un solo tipo di segnale. Scegli il trigger che corrisponde a come pensi al guasto: Stai già guardando un guasto sulla pagina Errori? Ogni riga lì ha un pulsante + avviso che apre questo stesso form precompilato per cogliere quel guasto esatto di nuovo, così l’incidente che hai appena triato diventa quello che ti avviserà la prossima volta. Dove trovarlo: Gli avvisi si trovano in /<org-slug>/alerts. La creazione, modifica, eliminazione e test delle regole richiede alerts:write; alerts:read è sufficiente per visualizzare. Il picker dei destinatari elenca i membri della tua organizzazione per nome, così puoi avvisare una persona senza lasciare il form.

Avvisami solo quando è reale

Una misurazione errata non dovrebbe svegliarti. Il filtro di rumore M di N controlla quanti degli ultimi controlli devono fallire prima che l’avviso ti paghi effettivamente. Impostalo su 3 di 5 e la regola si attiva solo dopo che ha violato tre dei suoi ultimi cinque controlli, quindi un segnale instabile smette di dare falsi allarmi; lascialo al default 1 di 1 per attivarsi al primo sfondamento. Scegli anche con quale frequenza la regola viene eseguita, da preset di 1m, 5m, 15m e 1h, adattati a quanto veloce il segnale si muove veramente.

Cosa succede quando un avviso si attiva

Una violazione apre un incidente e avvisa i tuoi canali una volta. Da lì il tuo team lo riconosce, assegna un proprietario, ne discute e lo risolve, tutto su un registro pulito e attribuito. Quel flusso di lavoro di triage ha la sua casa: vedi Incidenti.

Correlati

  • Incidenti: traccia un avviso che si attiva da aperto a riconosciuto a risolto.
  • Tracciamento degli errori: raggruppa i guasti degli agenti e promuovi uno a avviso in un click.
  • Dashboard: osserva le board condivise da cui provengono le soglie su cui avvisi.
  • CLI e agenti: crea avvisi e riconosci incidenti dal tuo terminale, o scrivili in CI.