Traccia i segnali di affidabilità che contano per un agente o un flusso di lavoro.
I dashboard combinano query salvate in una visualizzazione operativa. Costruisci uno intorno a una decisione che ti aspetti che qualcuno prenda—non intorno a ogni metrica disponibile.
Vai a Analyze → Queries, crea o apri una query salvata e convalida il risultato.
Seleziona add to dashboard, quindi scegli un dashboard esistente o creane uno in Analyze → Dashboards.
Apri il dashboard, accedi alla modalità di modifica, disponi i riquadri e salva il layout.
Ritorna alla query quando devi modificare i dati o i filtri dietro un riquadro.
Le operazioni CRUD del dashboard non sono esposte dalla Cloud CLI attuale. Usa la CLI per costruire e verificare la query salvata, quindi aggiungila a un dashboard nell’interfaccia utente.
Models: volume, latenza, utilizzo di token, tasso di errore e punteggi di valutazione.
Evaluations: tasso di successo e tendenze dei punteggi per agente o ambiente.
Tools: volume di chiamate, tasso di errore, durata e chiamate ripetute.
Hooks and policies: decisioni, negazioni e tasso di corrispondenza delle policy.
Custom workflow metrics: risultati dai tuoi campi evento personalizzati e SQL.
Inizia con una query salvata, convalida il risultato, quindi aggiungilo come riquadro. Mantieni i filtri di produzione e sviluppo espliciti in modo che il traffico di test non nasconda una regressione.
Assegna a ogni dashboard un proprietario e una domanda di risposta, ad esempio “L’affidabilità di checkout-agent è peggiore rispetto alla scorsa settimana?”