Skip to main content
追踪记录将扁平的事件流转化为运行过程的因果叙事。从第一个偏差点开始阅读,而不是从最后一个错误往回倒推。

打开追踪记录

  1. 前往 Observe → Sessions,打开一个会话。
  2. 使用概要面板检查结果、耗时、错误和评估分数。
  3. 扫描时间线和缩略图。当会话较大时,可按事件类型或时间范围过滤。
  4. 选择一个事件进行详细查看。使用 export 导出评估器 JSON,或复制页面 URL 以分享指向所选证据的深链接。 会话详情视图,包含执行图、事件时间线、评估面板,以及工具、模型和 hook 的分项统计。
1

建立整体认知

确认 agent、环境、耗时、结果和持续时间,然后扫描错误、长耗时片段、重复调用的工具、人工等待以及被策略拒绝的操作。
2

展开第一个可疑事件

检查其请求、响应、工具输入、输出和关联 ID。敏感内容仅在启用对话记录捕获且您具有相应权限时可见。
3

审查前序上下文

根因往往藏在更早的一个事件中:模型响应有误、工具结果缺失或存在过时的前置假设。
4

将证据转化为行动

将该会话添加到审计范围、关联到某个问题,或根据该故障模式编写一条策略。
持续时间长并不一定意味着模型延迟。在决定修复方向之前,请先将模型耗时、工具耗时、hook 耗时和人工等待时间分开统计。