
对每个智能体的实时脉搏
当智能体启动一次运行、调用模型、触发工具、执行钩子或遭遇错误时,该行会在事件发生的瞬间出现在流的顶部。它实时追踪你组织中每个智能体的所有事件,最新的排在最前,让你始终掌握当前状态,而非过时信息。 这意味着你无需在某台服务器上追踪日志文件,无需跨机器 grep,也无需手动拼凑时间戳。打开一个页面,你就已经在监视生产环境。 各行按类型用颜色编码,你一眼就能读懂流,而不必逐行解析。每行一眼可见:- 类型,颜色编码:
agent_start、model_response、tool_use、hook_completed、error等。 - 一行摘要,描述发生了什么,这样你几乎不需要点开任何内容就能了解要点。
- 该步骤的 Token 计数。
- 上下文窗口占用徽章(适用时),让提示词增长和即将到来的压缩在造成影响前就清晰可见。
找到那条关键运行记录
当某些情况看起来不对劲时,你不需要面对海量数据,你需要的是那条出问题的单次运行。事件流的过滤很迅速:按环境、按智能体、按会话、按事件类型,或按自由文本。 按会话 ID 或智能体 ID 过滤,可以从第一个事件到最后一个事件追踪一次运行的完整过程。按事件类型过滤,可以隔离某一类活动,例如在一个视图中查看组织内所有的error。叠加过滤条件,几次点击就能从”所有内容、全部范围”缩小到”这个智能体、在生产环境、正在报错”,然后采取相应行动。
自由文本搜索可以直接定位到某条消息、某个工具名称或你手头已有的 ID,让客户反馈在几秒内变成精确的运行记录。
在哪里找到它
事件流是你的组织主页。登录后,它是你首先看到的界面,位于/<org-slug>/,让你一到达就能立刻开始排查。
在其背后,你的智能体通过 SDK 发送事件,收集器将它们传输到你的 Failproof AI 可观测性服务器,流在事件到达时对其进行追踪,整个基础设施由你掌控。如果你需要的是汇总视图而非原始记录,每次运行的事件会在”会话”中折叠为一行,一键即达。
这是所有其他观测界面所基于的原始数据来源,因此当其他地方的数字看起来有误时,事件流就是你确认真实情况的地方。
相关内容
- Sessions:相同的事件按每次运行汇总为一行,并附有 git 风格的执行图。
- Telemetry:你的智能体发送什么内容,以及事件如何到达流。
- Error tracking:统一的错误排查界面,涵盖所有出错情况。
- Alerts:将任意阈值转化为告警规则。
- CLI and agents:从终端获取相同的实时追踪。

