Skip to main content
当智能体出现意外行为时,会话是最佳的起点。它将同一次运行中的模型请求、响应、工具调用、人工交互、错误、评估和策略决策整合在一起。 无论使用哪种框架,会话的格式都是一致的。一次重写代码仓库的 Claude Code 运行、一个在 Slack 中回答客户的 Hermes 智能体,以及一个通过 SDK 进行插桩的 Python 服务,都会以相同的追踪格式落地,因此一个视图即可覆盖整个集群。
跟踪一次智能体运行的完整过程——从目标设定,到模型调用、工具使用,直至最终响应。

查找会话

  1. 在云端侧边栏中,前往 Observe → Sessions
  2. 设置时间范围,然后按环境、状态、智能体或会话 ID 进行筛选。
  3. 需要按质量、成本、Token 数或延迟切片时,可添加分数或指标范围过滤条件。
  4. 点击某一行以打开其追踪详情。分享时,使用会话 ID 旁边的复制按钮。 Sessions 列表,每次运行显示为一行,支持按环境、智能体、状态和评估分数进行筛选。

你可以做什么

  • 按智能体、环境、时间、模型、事件类型或错误状态查找运行记录。
  • 追踪产生某一结果的完整事件序列。
  • 对比成功和失败的运行。
  • 查看审计发现或告警事件所使用的证据。
  • 导出会话以获取离线记录。

可靠的排查顺序

  1. 确认会话目标和运行环境。
  2. 找到第一个错误或意外决策——而不仅仅是最终的失败点。
  3. 检查该事件发生前的模型上下文和工具输入。
  4. 查看重试次数、延迟情况和人工干预记录。
  5. 审查评估分数和策略决策。

读取追踪

了解如何从会话摘要导航到引发结果的具体事件。