Skip to main content
Просматривайте все сбои ваших агентов в одном месте, сгруппированные так, чтобы множество похожих ошибок отображалось как одна проблема. Вы получаете прямой путь от “что-то красное” к точному запуску, который вызвал сбой, без прокрутки живого потока событий. Страница ошибок: гистограмма сбоев во времени над сгруппированными красными строками ошибок, каждая с кнопкой "+ alert" в один клик Страница ошибок: гистограмма сбоев во времени с повторяющимися сбоями, свёрнутыми в одну строку на инцидент.

Каждый сбой уже собран для вас

Когда агент ломается, вам не нужно прокручивать живой поток событий в надежде поймать красные строки перед тем, как они исчезнут. Страница Errors (Ошибки) собирает это за вас. Она объединяет всё, что приборная панель отметила бы как красное, в одну поверхность для сортировки, так что первое, что вы видите — это что именно ломается, а не где это искать. И она ловит больше, чем только очевидные сбои. Наряду с явными событиями error, Failproof AI Observability выявляет и тихие сбои: любой tool_result, hook_completed или agent_end, в полезной нагрузке которого есть сбой, появляется здесь. Инструмент, вернувший ошибку, или хук, завершившийся неудачно, больше не пройдёт мимо вас просто потому, что ничего не выбросило громкого исключения. В верхней части гистограмма отображает ошибки во времени. Один взгляд подскажет вам, это постоянный фоновый поток или всплеск, начавшийся несколько минут назад, так что вы сразу узнаете, стоит ли отвлекаться. Как и каждая страница observe, страница Errors ограничена вашей организацией и фильтруется по диапазону дат, окружению, агенту и сессии. Это означает, что вы можете взять список всего флота и сузить его до одного агента или одного окружения, которое вас действительно интересует.

Один инцидент, а не сотня одинаковых строк

Одна сломанная зависимость может вызвать одну и ту же ошибку сотни раз в минуту. В необработанном виде это стена из практически идентичных строк, которая скрывает единственное, что вам действительно нужно увидеть. Failproof AI Observability сворачивает повторяющиеся сбои, которые имеют одинаковую сессию и тип ошибки, в одну строку. Всплеск читается как один инцидент. Вы в итоге считаете проблемы, а не строки логов, и сигнал, который имеет значение, остаётся на виду вместо того, чтобы быть захороненным своим собственным объёмом.

От “что-то красное” к точному событию

Нажмите на любую строку, чтобы перейти прямо в сессию этого запуска, позиционированную на точном событии, которое привело к сбою. Никакого копирования ID сессий, никакой прокрутки в поисках момента, когда всё пошло не так: вы окажетесь прямо на нём, с полным графиком выполнения в одном взгляде, чтобы вы могли увидеть, что делал агент в моменты перед тем, как он сломался. Если у вас есть alerts:write, каждая строка также содержит кнопку + alert. Нажмите на неё, и Observability откроет новое правило оповещения, уже заполненное для отлова того же сбоя снова. Инцидент, который вы только что рассортировали, станет тем, который вас оповестит в следующий раз, вместо того чтобы застать вас врасплох дважды. Где это найти: страница Errors находится в разделе observe приборной панели по адресу /<org-slug>/errors.

Связанное

  • Alerts: превратите любой сбой в правило оповещения.
  • Incidents: отслеживайте срабатывающее оповещение от открытия до разрешения.
  • Sessions: откройте полный запуск за любой ошибкой.
  • Audits: позвольте Observability найти закономерности в сбоях ваших запусков.