Skip to main content
Failproof AI Observability — это самостоятельно размещаемая платформа для наблюдения, оценки и улучшения ваших AI-агентов в продакшене. Она фиксирует всё, что делают ваши агенты (каждый вызов инструмента, запрос к модели, hook и ошибку), оценивает качество каждого запуска и выявляет сбои, на которые вы не смотрели, всё это в панели управления, работающей в вашей инфраструктуре. Если вы развёртываете AI-агентов и устали гадать, почему запуск пошёл не так, эта страница — ваша отправная точка. Здесь объясняется, что вам даёт Failproof AI Observability и как всё взаимодействует, прежде чем вы что-то устанавливать.
Failproof AI Observability — это корпоративный продукт компании Failproof AI. Хотите увидеть его в действии? Запросите демонстрацию: напишите на nikita@befailproof.ai.
Сеанс Failproof AI Observability, изображённый в виде графа выполнения в стиле git рядом с временной шкалой событий, с разбивкой каждого запуска на инструменты, модели и hooks в правой панели Каждый запуск агента отображается в виде графа выполнения в стиле git (слева) рядом с его временной шкалой событий. Параллельные под-агенты получают свою полосу; в правой панели показаны инструменты, модели, hooks и расход токенов для запуска.

Посмотрите в действии

Два коротких видео показывают две вещи, на которые команды обращают внимание в первую очередь: трассировка запуска и автоматический поиск сбоев.
Трассировка агента: следите за одним запуском шаг за шагом, от цели к инструментам и финальному ответу.
Failproof Audit: позвольте Failproof AI Observability проанализировать ваши логи во всех сеансах и показать, что нужно исправить.

Почему команды её используют

  • Узнайте, что действительно делал ваш агент. Каждый запуск становится читаемым графом выполнения в стиле git: какие инструменты работали параллельно, какие под-агенты ветвились, где он зависал и что стоило.
  • Автоматически ловите падение качества. Подключите небольшой сервис оценки, и Failproof AI Observability оценит каждый завершённый запуск, чтобы падение полезности или всплеск галлюцинаций стали очевидны.
  • Найдите сбои, для которых вы не написали правила. Повторяющиеся аудиты анализируют ваши логи во всех сеансах в поиске кластеров ошибок, выбросов латентности, низких оценок и зависаний, а затем выдают вам ранжированные, подтвёрённые результаты.
  • Получайте уведомления, когда это важно. Правила по порогам срабатывают на основе частоты ошибок, латентности, стоимости или оценок оценивателя и открывают инциденты, которые вы можете подтвердить, назначить и разрешить.
  • Задавайте вопросы на обычном английском. AI-ассистент в панели управления ответит на вопросы вроде «как качество развивается в продакшене на этой неделе?» по вашим данным. Любое изменение требует одобрения.
  • Держите ваши данные под контролем. Failproof AI Observability является самостоятельно размещаемым: события, промпты и аналитика остаются в инфраструктуре, которую вы контролируете.

Что вы получаете

Failproof AI Observability организована вокруг трёх концепций (observe, analyze и admin), отражённых в левой боковой панели панели управления. Observe (сырая правда о том, что произошло):
  • Поток событий: живая, пошаговая цепь всех запусков (вызовы инструментов, вызовы моделей, hooks, ошибки).
  • Сеансы: эти события сведены в одну строку на запуск, каждый готов к оценке, с графом выполнения в стиле git.
  • Метрики производительности: тепловые карты латентности для каждой поверхности и жизненно важные показатели p50/p95/p99 для моделей, инструментов и hooks, чтобы всплеск на хвосте выделялся из медианы.
  • Отслеживание ошибок: единая поверхность для триажа всего, что пошло не так, в один клик от срабатывающего предупреждения.
Страница инструментов в Observe: тепловая карта латентности, полоса перцентилей и диаграмма распределения инструментов более 24 временных бинов Каждая поверхность наблюдения объединяет искромётную линию и жизненно важные показатели p50/p95/p99 с тепловой картой латентности и полосой перцентилей. Показано здесь: инструменты. Analyze (преобразуйте активность в ответы):
  • Запросы и панели управления: сохранённый SQL по вашим событиям и оценкам, представленный в виде общих, ориентированных на организацию панелей управления.
  • Оценки: оценки качества, полученные от вашего собственного сервиса оценивателя, с рассуждением для каждой оценки.
  • Аудиты: повторяющиеся исследования, выявляющие закономерности сбоев во всех сеансах.
  • Предупреждения и инциденты: правила по порогам, которые вызывают уведомления, плюс рабочий процесс инцидентов для их триажа.
Интерфейсы (получайте доступ к вашим данным своим способом):
  • CLI: управляйте всем развёртыванием из терминала или скрипта, и позвольте кодирующему агенту делать это за вас на обычном английском.
  • AI-ассистент: задавайте вопросы о ваших агентах на обычном английском прямо в панели управления.
  • REST API: всё, что делают панель управления и CLI, поддерживается REST API, который вы можете вызывать напрямую с помощью ограниченного API ключа — принимайте события, запрашивайте сеансы и оценки, управляйте панелями управления, предупреждениями, аудитами, пользователями и ключами, чтобы интегрировать Failproof AI Observability в свой инструментарий.
Admin (управляйте это для своей команды):
  • API ключи: ограниченные токены для коллектора, панели управления и ассистента.
  • Пользователи: вход без пароля на основе электронной почты с использованием списка разрешений.
  • Параметры: конфигурация для каждой организации, включая переопределения размера контекстного окна модели.

Как всё взаимодействует

Данные движутся в одном направлении, от вашего кода агента к панели управления: ваш агент (через Python SDK) выпускает события в agenteye-collector, который отправляет их на сервер, который служит панелью управления. Два дополнительных сервиса завершают картину — сервис оценки (оценки) и сервис AI-ассистента (чат в панели управления).
  • Python SDK: вы добавляете несколько вызовов agenteye.event.* в ваш агент; события буферизуются локально.
  • agenteye-collector: лёгкий демон на каждой машине с агентом, который группирует события и отправляет их на сервер.
  • Сервер: принимает ваши события, хранит операционное состояние в ваших собственных базах данных и служит REST API, который используют панель управления, CLI и ваши собственные интеграции.
  • Панель управления: где вы изучаете всё.
  • Дополнительные сервисы: сервис оценки (оценки) и сервис AI-ассистента (чат в панели управления).
Для словаря, используемого во всей документации (event, session, evaluation, audit, finding, incident), см. Concepts.

Получение Failproof AI Observability

Failproof AI Observability — это корпоративный продукт компании Failproof AI, и он работает вместе с Failproof AI Enforcement — продуктом политик и ограждений — под брендом Failproof AI. Он полностью работает в вашей среде. Если у вас ещё нет доступа к пакетам, запросите демонстрацию, и мы вас настроим: напишите на nikita@befailproof.ai.

Следующие шаги

  • Concepts: словарь Failproof AI Observability в одном месте.
  • Observability: следите за тем, что делают ваши агенты, запуск за запуском.
  • Security: как Failproof AI Observability держит ваши данные изолированными и под вашим контролем.