Función beta. La auditoría se lanza en beta mientras recopilamos
comentarios iniciales. El catálogo de detectores y el formato del informe
pueden cambiar antes de la próxima versión estable. Por favor, abre un issue
si algo parece incorrecto.
/audit — el arquetipo de tu agente, una puntuación
de 0 a 100, y exactamente qué políticas habrían detectado qué.
Ejecutar la auditoría
Hay tres formas de iniciarla — todas llevan al mismo informe/audit.
Sin instalación
npx -y failproofai audit descarga failproofai, ejecuta el análisis y abre
el panel automáticamente — no necesitas instalar nada antes.Desde la CLI
failproofai audit ejecuta el análisis en tu terminal y luego abre
localhost:8020/audit automáticamente al terminar.Desde el panel
Ejecuta
failproofai y haz clic en Audit en la barra de navegación
(entre Policies y Projects), o abre /audit directamente.cd <cwd>, bucles de polling con sleep, relectura de archivos recién editados, y más.
Por cada transcripción, cada evento de uso de herramienta se reproduce a través de las 39 políticas integradas y a través de 8 detectores exclusivos de auditoría que capturan patrones que aún no están cubiertos por las políticas en tiempo real. Los conteos se agregan por política/detector en todas las sesiones.
Qué obtienes
La página/audit es un póster de pantalla única y compartible, seguido de cuatro secciones debajo del pliegue:
- Póster — la identidad de tu agente de un vistazo: su arquetipo (uno de 8 —
optimist,cowboy,explorer,goldfish,paranoid architect,precision builder,hammer,ghost), sus palabras clave de personalidad, qué tan raro es ese arquetipo, y una puntuación de 0 a 100 con una banda de nivel (Shastabottom tier). Diseñado para compartir — publícalo en X o LinkedIn, o descárgalo como PNG. // strengths— lo que tu agente ya hace bien, con números reales del análisis (p. ej., porcentaje de llamadas de herramienta limpias,0intentos de push-to-main), mostrado solo donde la política relevante tiene un historial limpio.// quirks— lo que se escapó: una tabla ordenada de comportamientos que failproofai habría detectado — cuándo ocurrió por última vez, qué se escapó (y la política integrada que lo habría bloqueado), su severidad, y con qué frecuencia se detectó (new/recurring/N× seen).// how to improve— la lista de correcciones recomendadas: una fila por política con unfailproofai policy add <slug>listo para copiar y pegar, más un botón de instalar todo que habilita todas las recomendaciones a la vez y muestra tu puntuación proyectada si lo hicieras.// come back better— crea el hábito: configura un recordatorio de reauditoría por correo electrónico (3d/7d/14d/30d) o reaudita ahora, e invita a un amigo a ejecutar su propia auditoría (enviado desde failproof.ai, con copia a ti). Los recordatorios e invitaciones requieren iniciar sesión.
Auditorías programadas
Si ejecutas el daemon failproofaid (verfailproofai config),
puede volver a ejecutar la auditoría según un programa y actualizar el informe
/audit en segundo plano. Está desactivado por defecto, porque el análisis
lee el contenido de cada transcripción de sesión del agente en esta máquina
— nada se analiza con un temporizador hasta que lo solicites.
Actívalo en ~/.failproofai/config.toml:
- El programa es de reloj de pared, por lo que sobrevive a suspensiones y reinicios: una laptop que estaba dormida más allá de su hora programada ejecuta el análisis una vez al despertar, nunca un backlog acumulado.
- Cada ejecución es un proceso separado de baja prioridad (
nice 19) — nunca en la ruta del hook del daemon, que permanece libre para responder llamadas de herramientas. - Un análisis se omite si
failproofai audito la re-ejecución del panel ya están en curso; se reintenta poco después en lugar de tratarse como un error. - El progreso se escribe en
~/.failproofai/state/audit-schedule.json(última ejecución, próxima fecha). El daemon gestiona ese archivo — cambia la cadencia enconfig.toml.
Si habilitaste esto en una máquina configurada con una versión anterior de
failproofai, ejecuta
failproofai config una vez. La definición del servicio
del daemon necesita una entrada adicional antes de poder lanzar la CLI, y la
actualización forma parte de ese comando.Detectores exclusivos de auditoría
Estos detectan patrones de “comportamiento ineficiente” que aún no se aplican en tiempo real. Solo se ejecutan durante la auditoría y nunca bloquean una llamada de herramienta en vivo.Cachés
- Caché por transcripción en
~/.failproofai/cache/audit/<sha1>.jsoncon clave(mtime, size, engineVersion, detectorVersion)— se invalida automáticamente cuando cambia la transcripción o el código de política/detector. Cada entrada también almacena una marca de tiempocachedAtcomo metadatos de TTL (no forman parte de la clave de caché); las entradas con más de 7 días se rechazan al leer para que los resultados de larga duración no superen la intención cambiante de los detectores. - Caché de resultado completo en
~/.failproofai/audit-dashboard.json(modo 0600). Permite que el panel se renderice al instante al navegar sin necesidad de volver a ejecutar el análisis. También se rechaza al leer pasado el TTL de 7 días —/auditentonces cae a su estado vacío y solicita una nueva ejecución. Haz clic en[ re-audit now ]cerca de la parte inferior del informe para actualizar — la reauditoría envíanoCache: true, por lo que omite la caché por transcripción y vuelve a analizar cada transcripción en lugar de devolver el resultado en caché; la ejecución transmite el progreso mediante una banda fija en la parte superior y reemplaza el resultado en el lugar al completarse con éxito (sin recargar la página; una reauditoría fallida conserva el informe anterior).
Notas
- Sin mutaciones. La auditoría se reproduce en modo de solo lectura.
warn-repeated-tool-callsse omite porque su sidecar por sesión se modificaría de lo contrario. - Políticas de flujo de trabajo omitidas. Las políticas
require-*-before-stopsolo se activan en eventosStopy ejecutanexecSynccontra el estado de git en vivo — no tienen una interpretación significativa de “qué habría pasado en 2025”, por lo que no aparecen en los conteos de auditoría. - Políticas personalizadas omitidas. Los hooks personalizados suministrados por el usuario no se reproducen (pueden haber cambiado desde la sesión original).

