Skip to main content
Dites à votre agent de codage « ajoute Failproof AI Observability à cet agent » et laissez-le lire votre boucle, déterminer où placer l’instrumentation, l’écrire et vérifier les événements avant de considérer le travail terminé. La compétence SDK Python (agenteye-python-sdk) est une Agent Skill : un dossier d’instructions qu’un agent de codage tel que Claude Code ou Codex charge à la demande lorsqu’une tâche lui correspond. Elle apprend à l’agent à utiliser le SDK Python — ce n’est pas une bibliothèque, et elle ne modifie en rien le fonctionnement du SDK.

L’instrumentation est facile à écrire et facile à rater silencieusement

Le SDK est minimaliste : treize méthodes d’événements, toutes avec des paramètres nommés uniquement. Un agent de codage peut lire la référence du SDK Python et produire une instrumentation plausible en une minute. Le problème, c’est que ce SDK ne lève pas d’exception en cas d’erreur, et une mauvaise instrumentation ressemble exactement à une bonne instrumentation jusqu’à ce que quelqu’un ouvre un tableau de bord et le trouve vide. Les erreurs qui font perdre du temps sont toutes des silences : Aucun de ces cas ne lève d’exception. Aucun n’apparaît dans les tests. Chacun est documenté dans la compétence, énoncé comme un contrat avec la vérification qui le détecte.

Ce qu’elle fait, dans l’ordre

La compétence exécute les trois mêmes étapes qu’un ingénieur rigoureux suivrait :
  1. Planifier. Elle lit votre boucle d’agent et pose les deux questions auxquelles vous seul pouvez répondre : ce qui constitue une exécution (votre session_id), et qui sont les acteurs distinguables (votre agent_id). Elle obtient un accord sur ces points avant d’écrire du code, car les modifier plus tard divise votre historique et casse les tendances.
  2. Écrire. Elle lie l’identité une seule fois par exécution plutôt que de la propager à travers chaque point d’appel, et elle choisit une forme sûre pour la concurrence — un détail qui compte, car le raccourci évident mélange silencieusement deux exécutions simultanées en une seule session.
  3. Vérifier. Elle exécute votre agent et lit les fichiers d’événements résultants, en vérifiant que agent_start est présent, que l’environnement est correct et qu’une exécution a produit une session.
Cette troisième étape est celle que les gens ignorent. Le SDK écrit les événements dans des fichiers locaux, donc une intégration complète peut être prouvée sur un ordinateur portable sans serveur, sans clé API et sans réseau — c’est précisément pourquoi la compétence insiste pour le faire.

Son rapport aux autres compétences

Trois compétences, une séparation nette : Elles se relaient dans cet ordre : cette compétence fait circuler les événements, l’évaluateur les note, la CLI les relit. Il n’y a rien à évaluer et rien à lire tant que votre agent n’émet pas de sessions — donc si vous partez de zéro, commencez ici.

Prérequis

  1. Python 3.10+ et la base de code de l’agent que vous souhaitez instrumenter.
  2. Le SDK. Il est distribué aux clients sous forme de wheel privé plutôt que depuis un index public — votre intégration couvre comment l’obtenir et l’installer. La compétence connaît le chemin d’installation et vous demandera plutôt que de deviner si elle ne le trouve pas.
  3. Rien d’autre. Pas de connexion au tableau de bord, pas de clé API, pas de réseau. La compétence vérifie à partir des fichiers d’événements que le SDK écrit, elle peut donc terminer et prouver son travail hors ligne.

Où l’obtenir

La compétence se trouve dans la collection publique FailproofAI/skills :
Ajoutez -g pour l’installer pour tous les projets plutôt que pour le seul projet en cours, et --copy si votre environnement ne suit pas les liens symboliques. Pour Codex, passez -a codex.

Installation manuelle

Les Agent Skills sont des dossiers contenant un SKILL.md et des références associées. Si vous préférez ne pas utiliser l’installateur :
  • Claude Code : copiez le dossier agenteye-python-sdk/ dans ~/.claude/skills/ (tous les projets) ou <votre-dépôt>/.claude/skills/ (ce dépôt uniquement). Claude Code le découvre automatiquement — vérifiez la liste /skills, ou posez simplement une question qui lui correspond.
  • Codex : Codex lit le même SKILL.md. Le fichier agents/openai.yaml inclus définit allow_implicit_invocation: true, il est donc auto-sélectionné quand une tâche lui correspond ; sinon invoquez-le avec $agenteye-python-sdk.
Exécutez votre agent dans le dépôt contenant le code que vous souhaitez instrumenter — la compétence lit votre boucle d’agent avant de proposer quoi que ce soit.

À quoi ressemble une session

Le schéma à remarquer : il a lu le code avant de proposer, n’a posé que les questions auxquelles vous seul pouvez répondre, a réutilisé un id que vous aviez déjà, a choisi la forme sûre pour la concurrence parce qu’ il a vu un pool de threads, et a vérifié en lisant les événements réels plutôt qu’en déclarant le succès — puis a signalé l’endroit qu’il savait qui échouerait silencieusement.

Ce que vous pouvez lui demander

  • « Pourquoi mon agent n’apparaît pas sur le tableau de bord ? » → parcourt l’échelle : les événements sont-ils écrits, agent_start est-il présent, l’environnement est-il correct, le collecteur lit-il au bon endroit.
  • « Tout arrive sous dev. » → l’environnement n’a jamais été défini, ou a été réinitialisé par un appel ultérieur.
  • « Ajoute le suivi des tokens. » → trouve votre wrapper LLM et enregistre le modèle, la raison d’arrêt et l’utilisation.
  • « Instrumente aussi les sous-agents. » → une session, des étiquettes d’agent distinctes, imbriqués sous leur parent.
  • « Écris des tests pour l’instrumentation. » → pointe le SDK vers un répertoire temporaire et effectue des assertions sur les événements qu’il a écrits.

Points de vigilance

Laissez-le vérifier. L’étape qui rend cette compétence utile est la dernière — exécuter votre agent et relire les événements. Un agent qui écrit l’instrumentation et s’arrête a fait la moitié facile, et la moitié qui échoue silencieusement, c’est l’autre. Convenez des noms avant le code. session_id et agent_id sont les axes selon lesquels chaque surface regroupe les données. Les renommer plus tard divise l’historique : les anciennes exécutions conservent les anciennes étiquettes et vos tendances se cassent. La compétence posera la question ; la réponse mérite une minute de réflexion. Si votre agent propose d’installer le SDK depuis un index public, la compétence n’a pas été chargée. Le SDK est distribué en privé. Cette proposition est un signe révélateur que votre agent de codage improvise plutôt que de suivre la compétence — arrêtez-le là et vérifiez que la compétence est installée. En dehors de cela, son rayon d’action est limité : elle écrit du code dans votre répertoire de travail et des fichiers d’événements là où vous lui indiquez. Elle ne lit rien de votre déploiement et n’y change rien.

Étapes suivantes

  • SDK Python : la référence complète des événements — chaque type d’événement et chaque champ — derrière ce que cette compétence automatise.
  • Sessions : ce que produit votre instrumentation une fois les événements reçus.
  • Agent Skill Evaluator : l’étape suivante une fois que les exécutions arrivent — les noter.
  • Agent Skill CLI : relire votre télémétrie.