
Biết về các vấn đề trước khi người dùng của bạn biết
Ngừng làm mới bảng điều khiển hy vọng bắt kịp một lùi. Sử dụng cảnh báo bất cứ khi nào có tín hiệu mà bạn muốn biết ngay cả khi không ai đang theo dõi, và gửi nó đến nơi bạn đã có:- Email, cho bất cứ ai cần biết.
- Slack, một tin nhắn phong phú với nút bấm nhảy thẳng đến sự cố.
- Webhook, một JSON POST cho PagerDuty, Opsgenie, hoặc điểm cuối của riêng bạn, với chữ ký tùy chọn để người nhận có thể tin tưởng nó.
- Trên bảng điều khiển, yên tĩnh theo thiết kế, khi bạn điều chỉnh một quy tắc và không muốn thông báo cho ai cả.
Xây dựng quy tắc trong một biểu mẫu, không phải JSON
Bạn mô tả điều gì có nghĩa là “bị hỏng” trong một biểu mẫu, và Failproof AI Observability viết quy tắc cơ bản cho bạn. Thông số kỹ thuật JSON chỉ là những gì biểu mẫu đó tạo ra dưới nắp động cơ, vì vậy bạn có thể đọc nó để hiểu một quy tắc nhưng bạn hiếm khi nhập nó.
Đã staring tại một lỗi trên trang Lỗi? Mỗi hàng ở đó có nút + alert mở cùng biểu mẫu này được điền sẵn để bắt lỗi chính xác đó lại, vì vậy sự cố bạn vừa phân loại trở thành sự cố sẽ gửi cho bạn lần tiếp theo.
Nơi tìm thấy nó: Cảnh báo nằm ở
/<org-slug>/alerts. Tạo, chỉnh sửa, xóa và kiểm tra quy tắc cần alerts:write; alerts:read là đủ để xem. Bộ chọn người nhận liệt kê các thành viên của tổ chức bạn theo tên, vì vậy bạn có thể gửi thông báo cho một người mà không cần rời khỏi biểu mẫu.
Chỉ gửi cho tôi khi nó là thật
Một phép đo xấu không nên làm bạn thức dậy. Bộ lọc nhiễu M của N kiểm soát có bao nhiêu trong số những kiểm tra gần đây phải thất bại trước khi cảnh báo thực sự gửi cho bạn. Đặt nó thành 3 của 5 và quy tắc kích hoạt chỉ sau khi nó đã vi phạm ba trong năm kiểm tra gần đây của nó, vì vậy tín hiệu không ổn định sẽ ngừng gây sốt; để nó ở mức mặc định 1 của 1 để kích hoạt khi vi phạm đầu tiên. Bạn cũng chọn tần suất chạy quy tắc, từ các preset của 1m, 5m, 15m và 1h, phù hợp với tốc độ tín hiệu thực sự di chuyển.Điều gì xảy ra khi một cảnh báo kích hoạt
Một vi phạm mở một sự cố và gửi thông báo cho các kênh của bạn một lần. Từ đó nhóm của bạn xác nhận nó, gán một chủ sở hữu, thảo luận nó, và giải quyết nó, tất cả so với một bản ghi sạch và được ghi. Quy trình phân loại đó có nhà riêng: xem Sự cố.Liên quan
- Sự cố: theo dõi một cảnh báo kích hoạt từ mở đến xác nhận đến đã giải quyết.
- Theo dõi lỗi: nhóm các lỗi agent và quảng bá một lỗi thành cảnh báo chỉ bằng một cú nhấp chuột.
- Bảng điều khiển: theo dõi các bảng chia sẻ mà các ngưỡng bạn cảnh báo đến từ.
- CLI và agents: tạo cảnh báo và xác nhận sự cố từ terminal của bạn, hoặc script chúng vào CI.

