Skip to main content
Entérate en el momento en que algo cruza tu línea, en el canal que tu equipo ya monitorea, en lugar de que te lo diga un cliente. Define una regla una vez y Failproof AI Observability la evalúa según un calendario, notificándote por email, Slack, webhook o directamente en el dashboard. La página de Alertas: una cuadrícula de tarjetas de reglas de alerta, cada una con su disparador, ventana de evaluación, canales y una insignia de severidad informativa, de advertencia o crítica Todas las reglas de alerta de un vistazo: qué monitorea, con qué frecuencia, dónde notifica y qué tan urgente es.

Entérate de los problemas antes que tus usuarios

Deja de actualizar un dashboard esperando detectar una regresión. Configura una alerta cada vez que haya una señal que quieras conocer incluso cuando nadie esté mirando, y recíbela donde ya estás:
  • Email, para quienes deban saberlo.
  • Slack, un mensaje enriquecido con un botón que lleva directamente al incidente.
  • Webhook, un POST JSON para PagerDuty, Opsgenie o tu propio endpoint, con una firma opcional para que el receptor pueda verificar su origen.
  • En el dashboard, silencioso por diseño, para cuando estés ajustando una regla y aún no quieras notificar a nadie.
Combina cualquier cantidad de canales en una sola regla, y su severidad (informativa, de advertencia o crítica) viaja junto con ella para que las urgentes luzcan urgentes.

Crea la regla en un formulario, no en JSON

Describes lo que significa “roto” en un formulario y Failproof AI Observability escribe la regla subyacente por ti. La especificación JSON es simplemente lo que produce ese formulario internamente, así que puedes leerla para entender una regla, pero rara vez necesitarás escribirla. El formulario de nueva alerta: nombre y descripción, un interruptor de activación y un selector de disparador que ofrece umbral de métrica, SQL personalizado, puntuación de evaluación, evaluación compuesta y condiciones por evento Elige un disparador y el formulario muestra los campos correctos; Guardar escribe la regla. El flujo principal es rápido: nómbrala, elige un disparador (qué monitorear), define el umbral y la ventana (qué tan grave, durante cuánto tiempo), adjunta al menos un canal, luego Guarda y haz clic en Probar para enviar una notificación sintética y confirmar que todos los destinos están correctamente configurados. Internamente, eso produce una pequeña especificación como esta:
No estás limitado a un solo tipo de señal. Elige el disparador que se adapte a cómo piensas sobre el fallo: ¿Ya estás mirando un fallo en la página de Errores? Cada fila tiene un botón + alerta que abre este mismo formulario prellenado para detectar exactamente ese fallo en el futuro, de modo que el incidente que acabas de atender sea el que te notifique la próxima vez. Dónde encontrarlo: Las Alertas están en /<org-slug>/alerts. Para crear, editar, eliminar y probar reglas se necesita alerts:write; con alerts:read es suficiente para consultar. El selector de destinatarios lista a los miembros de tu organización por nombre, así que puedes notificar a una persona sin salir del formulario.

Notifícame solo cuando sea real

Una medición errónea no debería despertarte. El filtro de ruido M de N controla cuántas de las últimas verificaciones deben fallar antes de que la alerta te notifique realmente. Configúralo en 3 de 5 y la regla se activa solo después de que haya superado el umbral en tres de sus últimas cinco verificaciones, de modo que una señal inestable deje de dar falsas alarmas; déjalo en el valor predeterminado 1 de 1 para que se active en la primera infracción. También eliges con qué frecuencia se ejecuta la regla, a partir de intervalos predefinidos de 1m, 5m, 15m y 1h, ajustados a la velocidad real con que se mueve la señal.

Qué ocurre cuando se activa una alerta

Una infracción abre un incidente y notifica a tus canales una sola vez. A partir de ahí, tu equipo lo reconoce, asigna un responsable, lo discute y lo resuelve, todo con un registro limpio y atribuido. Ese flujo de trabajo de triaje tiene su propio espacio: consulta Incidentes.

Relacionado

  • Incidentes: sigue una alerta activa desde abierta hasta reconocida y resuelta.
  • Seguimiento de errores: agrupa fallos de agentes y conviértelos en una alerta con un clic.
  • Dashboards: monitorea los paneles compartidos de los que provienen los umbrales que alertas.
  • CLI y agentes: crea alertas y confirma incidentes desde tu terminal, o incorpóralos a scripts de CI.