
Arrêtez de laisser les moyennes masquer vos pires exécutions
Un chiffre de latence moyenne est rassurant et inutile : il lisse le seul appel sur cinquante qui bloque et réveille votre équipe d’astreinte à 2h du matin. Les pages Models, Tools et Hooks refusent de faire ça. Chacune partage la même structure, à apprendre une seule fois :- Un sparkline à 24 bins pour saisir la tendance d’un coup d’œil : la situation empire-t-elle ?
- Une bande de métriques vitales avec les latences p50, p95 et p99, pour voir côte à côte l’exécution typique et la queue de distribution.
- Une carte de chaleur de latence, 24 intervalles temporels croisés avec des buckets de latence, qui indique quand les appels lents se sont concentrés.
- Une bande de percentiles : une ligne p50 avec des rubans ombrés p25–p75 et p10–p90, et des points p99, afin que l’écart reste visible plutôt que noyé dans une moyenne.
Models : voyez exactement ce que chaque modèle vous coûte
La page Models (illustrée ci-dessus) répond aux deux questions qu’une facture soulève invariablement : quel modèle, et combien. En plus de la vue de latence partagée, elle ajoute la consommation de tokens par modèle, le coût estimé et le remplissage de la fenêtre de contexte, afin que la croissance incontrôlée des prompts et une compaction imminente soient visibles avant de vous surprendre. Failproof AI Observability reconnaît automatiquement les identifiants de modèles courants. Si une fenêtre semble incorrecte, ou si vous utilisez un modèle privé, corrigez-la ou ajoutez-en un depuis Settings, dans model context windows — les indicateurs de remplissage se mettront à jour en conséquence.Tools : distinguez la lenteur de la défaillance
Un appel d’outil peut être lent, ou il peut échouer silencieusement — et vous voulez savoir lequel en quelques secondes, pas après avoir fouillé des logs.
Hooks : identifiez le hook et le déclencheur exacts
Quand un hook de cycle de vie alourdit une exécution, constater que « les hooks sont lents » n’est pas exploitable. La page Hooks vous amène directement à celui qui pose problème.
Voir aussi
- Flux d’événements : la trace en direct, colorée, de chaque événement.
- Sessions : regroupez les événements en une ligne par exécution et ouvrez son graphe d’exécution.
- Suivi des erreurs : une surface de triage unique pour tout ce que le tableau de bord affiche en rouge.
- Tableaux de bord : vues agrégées sur l’ensemble de votre flotte.

