Skip to main content
बीटा फीचर। ऑडिट बीटा के रूप में शिप किया जा रहा है जबकि हम शुरुआती फीडबैक एकत्र करते हैं। डिटेक्टर कैटलॉग और रिपोर्ट फॉर्मेट अगले स्थिर संस्करण से पहले बदल सकते हैं। कृपया एक issue खोलें यदि कुछ गलत लगे।
ऑडिट आपके पिछले एजेंट-CLI ट्रांसक्रिप्ट्स को failproofai के policy इंजन के माध्यम से फिर से चलाता है और /audit डैशबोर्ड पेज पर एक साझा, विजुअल रिपोर्ट प्रदान करता है — आपके एजेंट का आर्कटाइप, एक 0–100 स्कोर, और बिल्कुल कौन सी पॉलिसीज क्या पकड़ सकती थीं।

इसे चलाएं

तीन तरीके — सभी एक जैसी /audit रिपोर्ट पर पहुंचते हैं।

कोई इंस्टॉलेशन नहीं

npx -y failproofai audit failproofai को फेच करता है, स्कैन चलाता है, और आपके लिए डैशबोर्ड खोलता है — पहले कुछ भी इंस्टॉल करने की जरूरत नहीं है।

CLI से

failproofai audit आपके टर्मिनल में स्कैन चलाता है, फिर जब यह समाप्त हो तो स्वचालित रूप से localhost:8020/audit खोलता है।

डैशबोर्ड से

failproofai चलाएं और नेवबार में Audit पर क्लिक करें (Policies और Projects के बीच), या सीधे /audit खोलें।
उपयोग देखने के लिए failproofai audit -h (या --help) चलाएं। ऑडिट पूरी तरह ऑफलाइन चलता है — कोई अकाउंट या नेटवर्क आवश्यक नहीं है — और डैशबोर्ड तब तक सेवा प्रदान करता रहता है जब तक आप इसे Ctrl+C से नहीं रोकते।
डैशबोर्ड इस मशीन पर पिछले एजेंट CLI ट्रांसक्रिप्ट्स को स्कैन करता है (Claude Code, Codex, Copilot, Cursor, OpenCode, Pi, Gemini) और रिपोर्ट करता है कि एजेंट कितनी बार ऐसी चीजें करता था जिन्हें failproofai रोकने के लिए बनाया गया है — env-var चेक्स, force pushes, अनावश्यक cd <cwd> प्रीफिक्स, sleep-polling loops, बस अभी edit की गई फाइलों को दोबारा पढ़ना, और अधिक। प्रत्येक ट्रांसक्रिप्ट के लिए, हर tool-use इवेंट को 39 बिल्ट-इन पॉलिसीज और 8 ऑडिट-केवल डिटेक्टर्स के माध्यम से दोबारा चलाया जाता है जो रनटाइम पॉलिसीज द्वारा अभी तक कवर न किए गए पैटर्न को पकड़ते हैं। गिनती को सभी सेशन्स में प्रति पॉलिसी / डिटेक्टर एकत्र किया जाता है।

आप क्या पाते हैं

/audit पेज एक सिंगल-स्क्रीन, साझा पोस्टर है जिसके बाद चार नीचे-के-गुंजन सेक्शन हैं:
  1. पोस्टर — एक नज़र में आपके एजेंट की पहचान: इसका आर्कटाइप (8 में से एक — optimist, cowboy, explorer, goldfish, paranoid architect, precision builder, hammer, ghost), इसके व्यक्तित्व कीवर्ड्स, वह आर्कटाइप कितना दुर्लभ है, और एक 0–100 स्कोर एक टियर बैंड के साथ (S नीचे bottom tier तक)। साझा करने के लिए बनाया गया — X या LinkedIn पर पोस्ट करें, या इसे PNG के रूप में डाउनलोड करें।
  2. // strengths — आपके एजेंट पहले से क्या अच्छी तरह करते हैं, स्कैन से वास्तविक संख्याओं के रूप में (उदा. clean-tool-call %, 0 push-to-main प्रयास), केवल जहां प्रासंगिक पॉलिसी का एक स्वच्छ रिकॉर्ड है।
  3. // quirks — जो छूट गया: failproofai पकड़ सकता था ऐसे व्यवहारों की रैंक की गई तालिका — कब यह अंतिम बार हुआ, क्या छूटा (और बिल्ट-इन जो इसे ब्लॉक कर सकता था), इसकी गंभीरता, और कितनी बार यह देखा गया (new / recurring / N× seen)।
  4. // how to improve — प्रस्तावित फिक्स सूची: एक पंक्ति प्रति पॉलिसी कॉपी-पेस्ट failproofai policy add <slug> के साथ, प्लस एक सभी को इंस्टॉल करें बटन जो हर सिफारिश को एक बार सक्षम करता है और आपके प्रोजेक्टेड स्कोर दिखाता है यदि आप ऐसा करते।
  5. // come back better — आदत बनाएं: एक पुनः-ऑडिट ईमेल रिमाइंडर सेट करें (3d / 7d / 14d / 30d) या अभी पुनः-ऑडिट करें, और एक दोस्त को आमंत्रित करें अपना स्वयं का ऑडिट चलाने के लिए (failproof.ai से भेजा गया, आपको Cc किया गया)। रिमाइंडर्स और आमंत्रण साइन-इन की आवश्यकता है — failproofai auth देखें।

ऑडिट-केवल डिटेक्टर्स

ये बेवकूफाना व्यवहार पैटर्न का पता लगाते हैं जो (अभी तक) वास्तविक समय में लागू नहीं किए जाते हैं। वे केवल ऑडिट के दौरान चलते हैं और कभी भी लाइव tool कॉल को ब्लॉक नहीं करते।

कैशेस

  • प्रति-ट्रांसक्रिप्ट कैश ~/.failproofai/cache/audit/<sha1>.json पर (mtime, size, engineVersion, detectorVersion) द्वारा कुंजीकृत — स्वचालित रूप से अमान्य हो जाता है जब ट्रांसक्रिप्ट या पॉलिसी/डिटेक्टर कोड बदलता है। प्रत्येक प्रविष्टि एक cachedAt टाइमस्टैम्प भी स्टोर करती है TTL मेटाडेटा के रूप में (कैश कुंजी का हिस्सा नहीं); 7 दिन से पुरानी प्रविष्टियों को पढ़ने पर अस्वीकार किया जाता है ताकि लंबे समय तक चलने वाले परिणाम विकसित होने वाले डिटेक्टर इरादे को आगे न जाएं।
  • पूर्ण-परिणाम कैश ~/.failproofai/audit-dashboard.json पर (मोड 0600)। डैशबोर्ड को पुनः-चलाए बिना नेविगेशन पर तुरंत रेंडर करने देता है। 7-दिन TTL के बाद पढ़ने पर भी अस्वीकार किया जाता है — /audit फिर अपनी खाली स्थिति पर गिरता है और एक नया चलाने के लिए संकेत देता है। रिपोर्ट के निचले भाग के पास [ re-audit now ] पर क्लिक करें ताज़ा करने के लिए — re-audit noCache: true भेजता है, इसलिए यह प्रति-ट्रांसक्रिप्ट कैश को बायपास करता है और कैश किए गए परिणाम को लौटाने के बजाय हर ट्रांसक्रिप्ट को दोबारा स्कैन करता है; चलाना एक स्टिकी शीर्ष पट्टी के माध्यम से प्रगति स्ट्रीम करता है और सफलता पर परिणाम को स्थान पर स्वैप करता है (कोई पेज रीलोड नहीं; एक विफल पुनः-ऑडिट पिछली रिपोर्ट रखता है)।

नोट्स

  • कोई परिवर्तन नहीं। ऑडिट केवल-पढ़ने मोड में फिर से चलता है। warn-repeated-tool-calls को छोड़ दिया जाता है क्योंकि इसका प्रति-सेशन साइडकार अन्यथा संशोधित होगा।
  • वर्कफ्लो पॉलिसीज छोड़ी गई। require-*-before-stop पॉलिसीज केवल Stop इवेंट्स और लाइव गिट स्थिति के विरुद्ध execSync पर फायर करती हैं — उनका कोई सार्थक 2025 में क्या हुआ होता की व्याख्या नहीं है, इसलिए वे ऑडिट गिनती में दिखाई नहीं देते हैं।
  • कस्टम पॉलिसीज छोड़ी गई। यूजर-आपूर्ति कस्टम हुक्स को फिर से नहीं चलाया जाता (वे मूल सेशन के बाद से बदल गए हो सकते हैं)।