skill-comply
affaan-m/ECC
Évalue automatiquement si les agents de codage respectent les compétences, les règles ou les définitions d'agent en générant des scénarios à différents niveaux de rigueur des consignes, en exécutant les agents, en classant les appels d'outils et en établissant des rapports sur les taux de conformité accompagnés d'un historique complet.
...Développer toutskill-comply: Évaluation automatisée de la conformité
Évalue si les agents de codage respectent effectivement les compétences, les règles ou les définitions d’agents en :
- Générer automatiquement des séquences de comportement attendues (spécifications) à partir de n’importe quel fichier .md
- Générer automatiquement des scénarios avec une rigueur décroissante des invites (favorable → neutre → antagoniste)
- L'exécution de `
claude -p` et la capture des traces d'appels d'outils via `stream-json` - Classant les appels d’outils par rapport aux étapes des spécifications à l’aide d’un LLM (et non d’expressions régulières)
- Vérification déterministe de l’ordre temporel
- Génération de rapports autonomes comprenant les spécifications, les invites et les chronologies
Cibles prises en charge
- Compétences (
skills/*/SKILL.md) : compétences de workflow telles que « search-first », guides TDD - Règles (
rules/common/*.md) : règles obligatoires telles que testing.md, security.md, git-workflow.md - Définitions d’agents (
agents/*.md) : vérification qu’un agent est bien invoqué au moment prévu (vérification interne du workflow non encore prise en charge)
Quand l’activer
- L'utilisateur exécute la commande
« /skill-comply » - L'utilisateur demande « cette règle est-elle réellement respectée ? »
- Après l’ajout de nouvelles règles/compétences, pour vérifier la conformité des agents
- Périodiquement, dans le cadre du maintien de la qualité
Utilisation
# Exécution complète
uv run python -m scripts.run ~/.claude/rules/common/testing.md
# Simulation (sans coût, spécifications et scénarios uniquement)
uv run python -m scripts.run --dry-run ~/.claude/skills/search-first/SKILL.md
# Modèles personnalisés
uv run python -m scripts.run --gen-model haiku --model sonnet
Concept clé : indépendance vis-à-vis de la requête
Évalue si une compétence/règle est respectée même lorsque la consigne ne la prend pas explicitement en charge.
Contenu du rapport
Les rapports sont autonomes et comprennent :
- La séquence de comportement attendue (spécification générée automatiquement)
- Consignes du scénario (ce qui a été demandé à chaque niveau de rigueur)
- Scores de conformité par scénario
- Chronologies des appels à l’outil avec les étiquettes de classification LLM
Fonctionnalités avancées (facultatives)
Pour les utilisateurs familiarisés avec les hooks, les rapports incluent également des recommandations de promotion de hooks pour les étapes présentant une faible conformité. Il s’agit d’une information à titre indicatif : la principale valeur réside dans la visibilité de la conformité elle-même.
---
name: skill-comply
description: Automatically measures whether coding agents follow skills, rules, or agent definitions by generating scenarios at multiple prompt strictness levels, running agents, classifying tool calls, and reporting compliance rates with full timelines.
---
# skill-comply: Automated Compliance Measurement
Measures whether coding agents actually follow skills, rules, or agent definitions by:
1. Auto-generating expected behavioral sequences (specs) from any .md file
2. Auto-generating scenarios with decreasing prompt strictness (supportive → neutral → competing)
3. Running `claude -p` and capturing tool call traces via stream-json
4. Classifying tool calls against spec steps using LLM (not regex)
5. Checking temporal ordering deterministically
6. Generating self-contained reports with spec, prompts, and timelines
## Supported Targets
- **Skills** (`skills/*/SKILL.md`): Workflow skills like search-first, TDD guides
- **Rules** (`rules/common/*.md`): Mandatory rules like testing.md, security.md, git-workflow.md
- **Agent definitions** (`agents/*.md`): Whether an agent gets invoked when expected (internal workflow verification not yet supported)
## When to Activate
- User runs `/skill-comply <path>`
- User asks "is this rule actually being followed?"
- After adding new rules/skills, to verify agent compliance
- Periodically as part of quality maintenance
## Usage
```bash
# Full run
uv run python -m scripts.run ~/.claude/rules/common/testing.md
# Dry run (no cost, spec + scenarios only)
uv run python -m scripts.run --dry-run ~/.claude/skills/search-first/SKILL.md
# Custom models
uv run python -m scripts.run --gen-model haiku --model sonnet <path>
```
## Key Concept: Prompt Independence
Measures whether a skill/rule is followed even when the prompt doesn't explicitly support it.
## Report Contents
Reports are self-contained and include:
1. Expected behavioral sequence (auto-generated spec)
2. Scenario prompts (what was asked at each strictness level)
3. Compliance scores per scenario
4. Tool call timelines with LLM classification labels
### Advanced (optional)
For users familiar with hooks, reports also include hook promotion recommendations for steps with low compliance. This is informational — the main value is the compliance visibility itself.
Tous les fichiers
21 fichiersInstaller skill-comply
Téléchargez et décompressez les fichiers de compétences dans votre répertoire .claude/skills/.
Télécharger le ZIPClonez le dépôt et copiez les fichiers de compétence dans votre projet.
git clone https://github.com/affaan-m/ECC/tree/main/skills/skill-comply # Copy SKILL.md to your .claude/skills/ directory
Copier





Maison
