Agent self-evaluation: structured 5-axis scorecard after any non-trivial task
Auto-noter son livrable sur précision, exhaustivité, clarté, applicabilité, concision — avec preuve concrète pour chaque note sous 5
- Quoi
- Auto-noter son livrable sur précision, exhaustivité, clarté, applicabilité, concision — avec preuve concrète pour chaque note sous 5
- Coût
- Gratuit
- Prérequis
- rien à installer — le skill est une méthodologie que votre agent applique après son travail ; aucun compte, clé ni dépendance
- Installation
- Copiez le prompt d’installation ci-dessous dans votre Muse — votre agent fait le reste.
Sélectionné par Skill Harbor — la discipline de réflexion de @affaan-m pour les agents : après toute tâche non triviale, marquer une pause et auto-noter son livrable sur cinq axes — précision, exhaustivité, clarté, applicabilité, concision — sur une échelle de 1 à 5, avec une règle de preuve stricte (toute note sous 5 doit citer exactement ce qui manque ou est faux ; « pourrait être mieux » ne compte pas). Le workflow se déroule en quatre étapes : collecter la matière première (demande, livrable, sorties d'outils, retours utilisateur), noter chaque axe indépendamment sans moyenner d'avance, produire un rapport structuré (résumé en une ligne, fiche à 5 axes avec preuves, moyenne globale, 1 à 3 améliorations classées par impact, et un auto-contrôle — « l'utilisateur serait-il d'accord avec cette évaluation ? »), puis appliquer la correction : les petits écarts (< 30 secondes) sont corrigés aussitôt, les plus gros sont signalés explicitement avec ce qu'une ré-exécution changerait. Inclut des exemples commentés de bonne vs mauvaise évaluation (fiches 4,6 contre 2,8), des anti-patterns (des 5 sans preuve, sur-pénaliser le hors-scope, rouvrir des décisions de conception, « je n'aime pas X » comme preuve), des bonnes pratiques (évaluer le livrable pas le processus, une amélioration par axe faible, relier les corrections à l'impact utilisateur, citer les tests/le lint comme preuve, « si tu ne trouves aucun écart, cherche mieux »), et des renvois vers des skills connexes (agent-eval, verification-loop, security-review). Licence MIT. Skill Harbor ne vérifie jamais le code, examinez-le vous-même avant usage. Découvert via skills.sh.
Version :
Installation
Prérequis : rien à installer — le skill est une méthodologie que votre agent applique après son travail ; aucun compte, clé ni dépendance Installe-moi « Auto-évaluation d'agent : fiche de notation structurée à 5 axes après toute tâche non triviale ». Il donne à mon agent la discipline de réflexion de @affaan-m : après toute tâche non triviale, noter son livrable de 1 à 5 sur précision, exhaustivité, clarté, applicabilité et concision avec preuve concrète exigée pour toute note sous 5 ; produire un rapport structuré (résumé, fiche de notes, moyenne globale, 1 à 3 améliorations classées, auto-contrôle « l'utilisateur serait-il d'accord ? ») ; puis corriger les petits écarts aussitôt ou indiquer explicitement comment une ré-exécution remonterait la note — plus exemples commentés, anti-patterns et bonnes pratiques. Licence MIT. Dépôt : https://github.com/affaan-m/ecc/blob/main/skills/agent-self-evaluation/SKILL.md 1. Récupère le fichier SKILL.md (et les fichiers d'aide éventuels) depuis le chemin du dépôt dans un dossier temporaire et résume en une ou deux phrases ce qu'il fait. 2. Vérification de sécurité : examine le SKILL.md et les scripts pour tout contenu suspect (appels réseau inattendus, commandes shell, collecte d'identifiants). Ce dépôt ne devrait contenir aucun secret en dur, les identifiants uniquement via le coffre sécurisé, les hôtes autorisés déclarés dans le SKILL.md. Vérifie que c'est bien le cas ici ; STOP sur tout signal d'alerte et dis-le-moi. 3. Installe-le comme skill : copie le SKILL.md et ses fichiers d'aide dans le répertoire des skills de l'agent, dans un dossier nommé « agent-self-evaluation ». 4. Vérifie sans appels réseau : frontmatter valide, fichiers en place. 5. Indique ce qui a été installé, où, et ce qu'il me reste à faire moi-même (p. ex. rien — c'est une méthodologie ; dites à l'agent de l'appliquer après sa prochaine tâche non triviale, ou via un hook Stop). GitHub est optionnel : si j'ai un compte GitHub ou la CLI gh, tu peux l'utiliser ; sinon l'accès public suffit. Ne jamais l'exiger sauf s'il figure dans les prérequis ci-dessus. Règles : ne touche à rien en dehors du dossier temporaire et de la cible d'installation. Si quelque chose semble anormal, arrête-toi et demande-moi.
Questions
Comment installer une création ?
Chaque fiche produit contient un prompt d’installation à copier-coller. Collez-le dans votre Muse et il installe la création pour vous — sans configuration manuelle.
Où va mon argent ?
Directement au vendeur. Skill Harbor ne traite jamais les paiements : le paiement se fait sur la page du vendeur, généralement via Stripe.
Que signifie le ✓ à côté du nom d’un créateur ?
Il signifie que nous avons confirmé l’identité de la personne derrière la fiche. Il ne dit rien sur le code lui-même — vérifiez toujours une création avant de l’installer.