
Soyez alerté des problèmes avant vos utilisateurs
Arrêtez de rafraîchir un tableau de bord dans l’espoir de détecter une régression. Configurez une alerte dès qu’il y a un signal que vous voudriez connaître même quand personne ne surveille, et recevez-la là où vous êtes déjà :- E-mail, pour toutes les personnes concernées.
- Slack, un message enrichi avec un bouton qui mène directement à l’incident.
- Webhook, un POST JSON pour PagerDuty, Opsgenie ou votre propre endpoint, avec une signature optionnelle pour que le récepteur puisse le valider.
- Dans le tableau de bord, discret par conception, pour quand vous affinez une règle et ne souhaitez pas encore envoyer de notification.
Créez la règle via un formulaire, pas du JSON
Vous décrivez ce que signifie « en erreur » dans un formulaire, et l’observabilité Failproof AI génère la règle sous-jacente pour vous. La spec JSON n’est que ce que ce formulaire produit en coulisses, vous pouvez la lire pour comprendre une règle, mais vous la saisissez rarement manuellement.
Vous êtes déjà en train d’examiner une défaillance sur la page Erreurs ? Chaque ligne dispose d’un bouton + alerte qui ouvre ce même formulaire pré-rempli pour détecter exactement cette défaillance à l’avenir, de sorte que l’incident que vous venez de traiter devient celui qui vous alertera la prochaine fois.
Où le trouver : Les alertes se trouvent à
/<org-slug>/alerts. La création, la modification, la suppression et le test des règles nécessitent alerts:write ; alerts:read suffit pour consulter. Le sélecteur de destinataires liste les membres de votre organisation par nom, vous pouvez donc notifier une personne sans quitter le formulaire.
Ne me notifier que lorsque c’est réel
Une mauvaise mesure ne devrait pas vous réveiller. Le filtre anti-bruit M sur N contrôle combien des dernières vérifications doivent échouer avant que l’alerte vous notifie réellement. Réglez-le sur 3 sur 5 et la règle ne se déclenche qu’après avoir dépassé le seuil lors de trois des cinq dernières vérifications, évitant ainsi les fausses alarmes d’un signal instable ; laissez-le sur la valeur par défaut 1 sur 1 pour déclencher dès le premier dépassement. Vous choisissez également la fréquence d’exécution de la règle, parmi les préréglages 1m, 5m, 15m et 1h, adaptée à la rapidité réelle d’évolution du signal.Ce qui se passe quand une alerte se déclenche
Un dépassement ouvre un incident et notifie vos canaux une fois. À partir de là, votre équipe le reconnaît, lui assigne un responsable, en discute et le résout, le tout dans un journal clair et attribué. Ce workflow de triage a son propre espace : voir Incidents.Voir aussi
- Incidents : suivez une alerte déclenchée de l’ouverture à l’acquittement jusqu’à la résolution.
- Suivi des erreurs : regroupez les défaillances des agents et transformez-en une en alerte en un clic.
- Tableaux de bord : consultez les tableaux partagés d’où proviennent les seuils que vous alertez.
- CLI et agents : créez des alertes et acquittez des incidents depuis votre terminal, ou intégrez-les dans votre CI.

