Skip to main content
不再猜测运行失败的原因。Failproof AI 可观测性将一次运行的所有事件汇总为一行可读记录,再将整个运行过程绘制成 git 风格的图示,让你几秒内看清全貌,逐步了解智能体究竟做了什么。 会话列表:每次运行占一行,跨越多个环境和智能体,附带状态标签和评估分数徽章 每次运行占一行:状态标签让你一眼看出运行结果,连接评估器后还会显示分数徽章。
智能体追踪:从目标到工具调用再到最终答案,逐步跟踪一次完整运行。

一眼纵览所有运行

原始事件流记录了每一步的真实情况,但当你面对数十次运行中的数千个步骤时,你需要的是运行层面的视图,而不是单步细节。会话页面将一次运行的所有事件汇总为一行,让一天的活动变成一份可快速浏览的列表,而非令人眼花缭乱的信息洪流。 每行都带有状态标签,让失败的运行在你点击之前就能一眼显现。按日期范围、环境、智能体或会话进行筛选,几次点击即可从「全部」缩小到「我关心的那次运行」。 连接评估器后,每次完成的运行都会自动获得评分,最新分数以徽章形式显示在对应行上。你可以按任意分数范围筛选,「显示本周所有低分生产运行」只是一个筛选条件,无需人工逐一查看。在设置评估器之前,会话仍然会完整记录运行过程,只是暂时没有分数。

以图示读懂整个运行过程

会话的 git 风格执行图与事件时间线并排显示,右侧面板展示工具、模型和 hook 的详细拆解 执行图(左侧)与事件时间线并排显示;右侧栏对本次运行使用的工具、模型、hook 以及 token 消耗进行详细拆解。 点击任意会话,即可打开其执行图:这是一个 git 风格的视图,展示了智能体、工具、hook 和模型调用随时间展开的过程。并行的子智能体各自分支到独立的泳道,让你清楚地看到哪些工作是并行执行的、哪个子智能体发生了停滞、以及运行在哪里偏离了预期——无需在脑海中从一堆日志中重新推演。 右侧栏提供逐次运行的详细拆解:哪些工具和模型参与了运行、哪些 hook 触发了、以及本次运行消耗了多少 token。「这次运行为什么这么贵?」或「哪个工具最慢?」的答案就在执行图旁边。 每个单独事件都有固定链接,因此你可以把某一时刻的链接直接分享给他人,而不是说「在那个会话里,大概三分之二的位置」。从任意事件复制链接,或从审计发现或错误中跳转,会话将打开并定位到该事件。对于非常长的运行同样适用:时间线出于浏览器性能考虑只加载有限的时间窗口,但指向窗口之外的链接仍然能定位到对应事件,而不是把你扔到最开始。如果该事件已超出你的数据保留窗口,页面会明确提示,而不是静默地选中空白内容。

在哪里找到它

每个控制台页面都限定在你的组织范围内(/<org-slug>/…)。会话功能位于左侧边栏的 Observe 下,紧邻 Events,列表顶部提供日期范围、环境、智能体和会话等筛选条件。每行点击一次即可进入完整执行图。 要开启分数徽章和按分数范围筛选的功能,请连接评估器,详见评估

相关内容

  • 事件流:每个会话汇总自原始的逐步事件记录。
  • 评估:连接评估器,让每次运行都获得可供筛选的分数徽章。
  • 遥测:了解运行数据如何从你的智能体传入这些会话。