Skip to main content
Smetti di indovinare perché un’esecuzione è fallita. Failproof AI Observability raggruppa ogni evento da un’esecuzione in una riga leggibile, poi disegna l’intera esecuzione come un’immagine in stile git che puoi leggere in pochi secondi, così vedi esattamente cosa ha fatto il tuo agent, passo dopo passo. L'elenco delle Sessioni: una riga per esecuzione, tra ambienti e agent, con badge di stato e valutazione Una riga per esecuzione: il badge di stato ti dice come è terminata l’esecuzione a prima vista, e un badge di punteggio appare quando è collegato un valutatore.
Tracciamento dell’agent: segui una singola esecuzione passo dopo passo, dal goal agli strumenti alla risposta finale.

Vedi ogni esecuzione a prima vista

Il percorso degli eventi grezzi è la verità di ogni passo, ma quando hai migliaia di passi su dozzine di esecuzioni, ti serve l’esecuzione, non il passo. La pagina Sessions raggruppa tutti gli eventi di un’esecuzione in una riga, così un giorno di attività diventa un elenco scansionabile invece di un diluvio di informazioni. Ogni riga ha un badge di stato, quindi un’esecuzione fallita si distingue da una sana prima ancora di fare clic. Filtra per intervallo di date, ambiente, agent o sessione per passare da “tutto” a “l’esecuzione che mi interessa” in un paio di clic. Una volta collegato un valutatore, ogni esecuzione completata viene valutata automaticamente e il suo punteggio più recente appare sulla riga come badge. Puoi filtrare per qualsiasi intervallo di punteggio, così “mostrami ogni esecuzione prod con punteggio basso questa settimana” è un filtro, non una revisione manuale. Finché non ne configuri uno, le sessioni continuano a catturare l’esecuzione completa; semplicemente non hanno ancora un punteggio.

Leggi l’intera esecuzione come un’immagine

Un grafico di esecuzione in stile git della sessione accanto alla sua timeline di eventi, con il pannello di scomposizione di strumenti, modelli e hook Il grafico di esecuzione (a sinistra) si siede accanto alla timeline degli eventi; il pannello di destra scompone gli strumenti, i modelli, gli hook e la spesa in token per l’esecuzione. Fai clic su qualsiasi sessione per aprire il suo grafico di esecuzione: una visualizzazione in stile git di come agent, strumenti, hook e chiamate ai modelli si sono svolti nel tempo. I sub-agent paralleli si diramano ognuno nella propria corsia, così puoi vedere quale lavoro è stato eseguito affiancato, quale sub-agent si è bloccato e dove l’esecuzione è andata fuori strada, senza riprenderla mentalmente da un muro di log. Il pannello di destra ti dà la scomposizione per esecuzione: quali strumenti e modelli sono stati eseguiti, quali hook sono stati attivati e cosa l’esecuzione ha speso in token. Questa è la risposta a “perché questa esecuzione è costata così tanto?” o “quale strumento è quello lento?” seduta proprio accanto al grafico che l’ha causata. I singoli eventi sono indirizzabili, così puoi dare a qualcuno un link a un momento specifico piuttosto che “la sessione, circa due terzi più in giù”. Copia il link da qualsiasi evento o segui uno da un risultato di audit o un errore, e la sessione si apre con quell’evento selezionato e fatto scorrere in vista. Questo vale anche per esecuzioni molto lunghe: la timeline carica una finestra limitata per il bene del tuo browser, e un link che punta oltre quella finestra comunque trova il suo evento piuttosto che lasciarti all’inizio. Se l’evento è invecchiato oltre la tua finestra di conservazione, la pagina te lo dice invece di selezionare silenziosamente nulla.

Dove trovarla

Ogni pagina della dashboard è scoped alla tua org (/<org-slug>/…). Sessions si trova sotto Observe nella barra laterale sinistra, accanto a Events, con i filtri di intervallo di date, ambiente, agent e sessione nella parte superiore dell’elenco. Ogni riga è a un clic dal suo grafico di esecuzione completo. Per attivare i badge di punteggio e il filtraggio per intervallo di punteggio, collega un valutatore: vedi Evaluations.

Correlati

  • Event stream: il percorso grezzo e per-passo da cui ogni sessione è stata raggruppata.
  • Evaluations: collega un valutatore in modo che ogni esecuzione ottenga un badge di punteggio per cui puoi filtrare.
  • Telemetry: come le esecuzioni vanno dal tuo agent in queste sessioni.