Skip to main content
追踪记录将扁平的事件流转化为运行过程的因果故事。从第一个偏差点开始读取,而不是从最后一个错误反向追溯。

打开追踪记录

  1. 前往 Observe → Sessions,打开一个会话。
  2. 使用概要摘要查看结果、耗时、错误和评估分数。
  3. 扫描时间线和缩略图。当会话较大时,可按事件类型或时间进行筛选。
  4. 选择某个事件以查看详情。使用 export 获取评估器 JSON,或复制页面 URL 以分享指向所选证据的深层链接。 会话详情视图,包含执行图、事件时间线、评估面板以及工具、模型和 hook 的分类统计。
1

建立整体认知

确认 Agent、环境、耗时、结果和持续时长,然后扫描错误、长耗时 span、重复调用的工具、人工等待以及被拒绝的策略决策。
2

展开第一个可疑事件

检查其请求、响应、工具输入、输出和关联 ID。敏感内容仅在启用对话记录捕获且您拥有相应权限时可见。
3

检查前序上下文

原因通常出现在更早的一个事件中:错误的模型响应、缺失的工具结果或过时的假设。
4

将证据转化为行动

将会话添加到审计范围、关联至某个问题,或根据失败模式编写策略。
持续时间长并不总意味着模型延迟。在决定如何修复之前,请先将模型、工具、hook 和人工等待时间分别区分开来。