
Lass Durchschnittswerte nicht mehr deine schlechtesten Läufe verbergen
Eine durchschnittliche Latenzangabe klingt beruhigend – und ist gleichzeitig nutzlos: Sie glättet genau jenen einen Aufruf unter fünfzig, der ins Stocken gerät und deinen Bereitschaftsdienst um 2 Uhr nachts weckt. Die Seiten Models, Tools und Hooks machen das nicht mit. Alle drei haben denselben Aufbau, den du nur einmal lernen musst:- Ein 24-Bin-Sparkline für den Trend auf einen Blick: Wird es schlechter?
- Ein Vitals-Streifen mit p50, p95 und p99 Latenz, damit der typische Lauf und der Ausreißer nebeneinander stehen.
- Eine Latency-Heatmap – 24 Zeitabschnitte gegen Latenz-Buckets –, die zeigt, wann sich die langsamen Aufrufe gehäuft haben.
- Ein Percentile-Band: eine p50-Linie mit schraffierten Bändern für p25–p75 und p10–p90 sowie p99-Punkte, sodass die Streuung sichtbar bleibt, anstatt weggemittelt zu werden.
Models: sieh genau, was jedes Modell dich kostet
Die Models-Seite (oben abgebildet) beantwortet die zwei Fragen, die eine Rechnung immer aufwirft: Welches Modell, und wie viel? Zusätzlich zur gemeinsamen Latenzansicht zeigt sie modellspezifischen Token-Verbrauch, geschätzte Kosten und die Kontextfenster-Auslastung – damit unkontrolliertes Prompt-Wachstum und eine bevorstehende Kompaktierung sichtbar werden, bevor sie dich überraschen. Failproof AI Observability erkennt gängige Modell-IDs automatisch. Falls ein Fenster falsch aussieht oder du ein eigenes privates Modell betreibst, korrigiere es oder füge eines unter Settings bei model context windows hinzu – die Auslastungsanzeigen passen sich entsprechend an.Tools: unterscheide langsam von defekt
Ein Tool-Aufruf kann langsam sein oder stillschweigend fehlschlagen – und du möchtest das in Sekunden wissen, nicht erst nach stundenlangem Log-Wühlen.
Hooks: den genauen Hook und Trigger ermitteln
Wenn ein Lifecycle-Hook einen Lauf verlangsamt, kannst du mit der Aussage „Hooks sind langsam” nichts anfangen. Die Hooks-Seite führt dich direkt zu dem einen, der das Problem verursacht.
Verwandte Seiten
- Event-Stream: der Live-Feed aller Events, farblich kodiert.
- Sessions: Events zu einer Zeile pro Lauf zusammenfassen und den Ausführungsgraphen öffnen.
- Fehlerverfolgung: eine zentrale Triage-Oberfläche für alles, was das Dashboard rot einfärbt.
- Dashboards: Übersichtsansichten über deine gesamte Flotte.

