title: गत सत्रों का ऑडिट (beta) description: “पिछले ट्रांसक्रिप्ट्स में एजेंट द्वारा कितनी बार अपव्यय या जोखिम भरे काम किए गए, इसकी गणना करें”
बीटा फीचर। ऑडिट बीटा के रूप में भेजा जा रहा है जबकि हम प्रारंभिक फीडबैक एकत्र कर रहे हैं।
डिटेक्टर कैटलॉग और रिपोर्ट फॉर्मेट अगले स्थिर संस्करण से पहले बदल सकते हैं। यदि कुछ गलत लगे तो कृपया एक issue खोलें।
/audit डैशबोर्ड पेज पर एक साझा करने योग्य, विजुअल रिपोर्ट प्रस्तुत करता है — आपके एजेंट की आर्केटाइप, एक 0–100 स्कोर, और बिल्कुल यह कि कौन-सी policies क्या पकड़ी होती।
इसे चलाएं
तीन तरीके हैं — सभी एक ही/audit रिपोर्ट पर पहुंचते हैं।
कोई इंस्टॉल नहीं
npx -y failproofai audit failproofai को फेच करता है, स्कैन चलाता है, और आपके लिए डैशबोर्ड खोलता है — पहले कुछ इंस्टॉल करने की जरूरत नहीं।CLI से
failproofai audit आपके टर्मिनल में स्कैन चलाता है, फिर समाप्त होने पर localhost:8020/audit को स्वचालित रूप से खोलता है।डैशबोर्ड से
failproofai चलाएं और navbar में Audit पर क्लिक करें (Policies और Projects के बीच), या सीधे /audit खोलें।cd <cwd> प्रिफिक्स, sleep-polling लूप, अभी-अभी edited फाइलें दोबारा पढ़ना, और अन्य।
प्रत्येक ट्रांसक्रिप्ट के लिए, हर tool-use इवेंट 39 builtin policies के माध्यम से और 8 audit-only डिटेक्टर्स के माध्यम से फिर से चलाया जाता है जो ऐसे पैटर्न को पकड़ते हैं जो अभी तक runtime policies द्वारा कवर नहीं हैं। गिनती सभी सत्रों में प्रति policy/डिटेक्टर एकत्र की जाती है।
आप क्या पाते हैं
/audit पेज एक एकल-स्क्रीन, साझा करने योग्य पोस्टर है जिसके बाद चार नीचे-फोल्ड अनुभाग हैं:
- पोस्टर — एक नजर में आपके एजेंट की पहचान: इसकी archetype (8 में से एक —
optimist,cowboy,explorer,goldfish,paranoid architect,precision builder,hammer,ghost), इसके persona keywords, वह archetype कितनी दुर्लभ है, और एक 0–100 स्कोर with a tier band (Sसेbottom tier)। साझा करने के लिए बनाया गया — X या LinkedIn पर पोस्ट करें, या इसे PNG के रूप में डाउनलोड करें। // strengths— स्कैन से वास्तविक संख्याओं के रूप में आपका एजेंट पहले से क्या अच्छा करता है (जैसे clean-tool-call %,0push-to-main प्रयास), केवल तब दिखाया जाता है जब संबंधित policy का स्वच्छ रिकॉर्ड हो।// quirks— जो फिसल गया: failproofai के पकड़े गए व्यवहारों की एक ranked तालिका — यह कब अंतिम बार हुआ, क्या फिसल गया (और जो builtin इसे ब्लॉक कर देता), इसकी severity, और यह कितनी बार देखा गया (new/recurring/N× seen)।// how to improve— निर्धारित फिक्स सूची: प्रति policy एक पंक्ति copy-pastefailproofai policy add <slug>के साथ, प्लस एक install all बटन जो हर recommendation को एक ही समय में सक्षम करता है और आपका projected score दिखाता है यदि आप करें।// come back better— आदत बनाएं: एक re-audit ईमेल reminder सेट करें (3d/7d/14d/30d) या अभी फिर से ऑडिट करें, और एक मित्र को आमंत्रित करें अपना स्वयं का ऑडिट चलाने के लिए (failproof.ai से भेजा जाता है, आपको Cc किया जाता है)। Reminders और invites को साइन-इन की आवश्यकता है —failproofai authदेखें।
Audit-only डिटेक्टर्स
ये “stupid behavior” पैटर्न को डिटेक्ट करते हैं जो (अभी तक) रीयल टाइम में enforce नहीं किए जाते हैं। वे केवल ऑडिट के दौरान चलते हैं और कभी live tool call को ब्लॉक नहीं करते हैं।कैशेस
- Per-transcript कैश
~/.failproofai/cache/audit/<sha1>.jsonपर(mtime, size, engineVersion, detectorVersion)द्वारा keyed — जब ट्रांसक्रिप्ट या policy/detector कोड बदलता है तो स्वचालित रूप से invalidate होता है। प्रत्येक entry एकcachedAttimestamp को TTL metadata के रूप में भी स्टोर करता है (कैश key का भाग नहीं); 7 दिन से पुरानी entries को पढ़ते समय अस्वीकार किया जाता है ताकि लंबे समय तक रहने वाले परिणाम विकसित होने वाले detector intent को पार न करें। - Whole-result कैश
~/.failproofai/audit-dashboard.jsonपर (mode 0600)। डैशबोर्ड को re-running के बिना navigation पर तुरंत प्रस्तुत करने देता है। 7-day TTL के बाद भी पढ़ते समय अस्वीकार किया जाता है —/auditतब इसकी empty state में गिरता है और एक fresh run को प्रेरित करता है। रिपोर्ट के नीचे के पास[ re-audit now ]पर क्लिक करें refresh के लिए — re-auditnoCache: trueभेजता है, इसलिए यह per-transcript कैश को बाईपास करता है और cached result देने के बजाय हर ट्रांसक्रिप्ट को फिर से स्कैन करता है; run एक sticky top strip के माध्यम से progress स्ट्रीम करता है और success पर परिणाम को जगह में स्वैप करता है (कोई page reload नहीं; एक failed re-audit पिछली रिपोर्ट को रखता है)।
नोट्स
- कोई mutation नहीं। ऑडिट read-only mode में फिर से चलता है।
warn-repeated-tool-callsको छोड़ दिया जाता है क्योंकि इसका per-session sidecar अन्यथा modify हो जाएगा। - Workflow policies छोड़ दिए जाते हैं।
require-*-before-stoppolicies केवलStopevents और live git state के विरुद्धexecSyncपर fire होती हैं — इनका meaningful “what would have happened in 2025” interpretation नहीं है, इसलिए वे audit counts में दिखाई नहीं देते हैं। - Custom policies छोड़ दिए जाते हैं। User-supplied custom hooks को फिर से चलाया नहीं जाता (वे original session के बाद से बदल सकते हैं)।

