
Entérate de los problemas antes que tus usuarios
Deja de actualizar un dashboard esperando detectar una regresión. Configura una alerta cada vez que haya una señal que quieras conocer incluso cuando nadie esté mirando, y recíbela donde ya estás:- Email, para quienes deban saberlo.
- Slack, un mensaje enriquecido con un botón que lleva directamente al incidente.
- Webhook, un POST JSON para PagerDuty, Opsgenie o tu propio endpoint, con una firma opcional para que el receptor pueda verificar su origen.
- En el dashboard, silencioso por diseño, para cuando estés ajustando una regla y aún no quieras notificar a nadie.
Crea la regla en un formulario, no en JSON
Describes lo que significa “roto” en un formulario y Failproof AI Observability escribe la regla subyacente por ti. La especificación JSON es simplemente lo que produce ese formulario internamente, así que puedes leerla para entender una regla, pero rara vez necesitarás escribirla.
¿Ya estás mirando un fallo en la página de Errores? Cada fila tiene un botón + alerta que abre este mismo formulario prellenado para detectar exactamente ese fallo en el futuro, de modo que el incidente que acabas de atender sea el que te notifique la próxima vez.
Dónde encontrarlo: Las Alertas están en
/<org-slug>/alerts. Para crear, editar, eliminar y probar reglas se necesita alerts:write; con alerts:read es suficiente para consultar. El selector de destinatarios lista a los miembros de tu organización por nombre, así que puedes notificar a una persona sin salir del formulario.
Notifícame solo cuando sea real
Una medición errónea no debería despertarte. El filtro de ruido M de N controla cuántas de las últimas verificaciones deben fallar antes de que la alerta te notifique realmente. Configúralo en 3 de 5 y la regla se activa solo después de que haya superado el umbral en tres de sus últimas cinco verificaciones, de modo que una señal inestable deje de dar falsas alarmas; déjalo en el valor predeterminado 1 de 1 para que se active en la primera infracción. También eliges con qué frecuencia se ejecuta la regla, a partir de intervalos predefinidos de 1m, 5m, 15m y 1h, ajustados a la velocidad real con que se mueve la señal.Qué ocurre cuando se activa una alerta
Una infracción abre un incidente y notifica a tus canales una sola vez. A partir de ahí, tu equipo lo reconoce, asigna un responsable, lo discute y lo resuelve, todo con un registro limpio y atribuido. Ese flujo de trabajo de triaje tiene su propio espacio: consulta Incidentes.Relacionado
- Incidentes: sigue una alerta activa desde abierta hasta reconocida y resuelta.
- Seguimiento de errores: agrupa fallos de agentes y conviértelos en una alerta con un clic.
- Dashboards: monitorea los paneles compartidos de los que provienen los umbrales que alertas.
- CLI y agentes: crea alertas y confirma incidentes desde tu terminal, o incorpóralos a scripts de CI.

