Défaut (1re vraie édition de prod après plusieurs sessions de sondes « 0 édition ») :
quality_spec.json:66 attribuait au générateur de faisabilité 4 volets la fenêtre roadmap
« S2 » avec un source falsifiable-faux (« roadmap Sprint 2 · Faisabilité… »), alors que la
roadmap n'a AUCUNE faisabilité au Sprint 2 (Console/CRM/RBAC) et place « génération 4 volets »
au Sprint 3 (L43, livrable L46 « P07 faisabilité complète auto-générée »). Cause racine :
confusion de 2 cadres de sprint — le label agent-interne « S2 » (AGENT.md §130-133 : phases
S1 template/S2 générateur/S3 versioning, toutes ancrées roadmap Sprint 3) recopié dans le
champ roadmap-global (seul quality_spec le porte, toutes ses entrées sourcent « roadmap
Sprint N »). Effet : le livrable-phare S3 était prouvé SANS son propre générateur, ce dernier
mal-classé comme preuve du S2 (dashboards/CRM/RBAC) sans rapport.
Correctif coordonné 2-spec + régénération byte-gatée :
- quality_spec.json:66 : sprint S2→S3 + source recitée « roadmap Sprint 3 » (style aligné sur
le jumeau bancable, déjà S3).
- acceptance_spec.json : generator retiré de evidence_modules S2, ajouté à S3
(sinon invariant 5 « partition exacte » casse : want lu dans quality_spec ≠ have déclaré).
- régénération audit_4big PUIS acceptance (lit la fenêtre depuis quality_spec).
Vérif : partition_ok=True · bijective=True · S2=6 (publiciste+5 rbac) · S3={bancable,generator}
· run_ci 33 PASS · score 4Big générateur inchangé 100/100 (le champ sprint ne sert qu'au tri+méta,
pas d'oracle de scoring). Portée honnête : 5 fichiers (2 specs + 3 artefacts régénérés) + log.
0 doc de module éditée (les ~10 « S2 » ailleurs = cadre agent-interne, corrects, #5) · daily_reports
= historique non réécrit · 0 gate ajouté (déjà gaté par inv5) · 0 chiffre inventé (#6) · 0 VPS (#8).
Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
Audit 4Big qualité · Sprint 7 · QA
Roadmap Sprint 7 · QA — « Audit 4Big niveau 95+/100 sur 100% deliverables » · CLAUDE.md #5 (score minimum 95/100, niveau 4Big obligatoire sur tout livrable).
Générateur d'un audit de méta-niveau : il note la qualité 4Big de 100 % des
livrables du mandat et bloque (verdict FAIL) si un seul module tombe sous
95/100 ou si la couverture n'est pas complète. C'est un gate, pas un
rapport indicatif.
Ce qu'il fait
-
Découvre le périmètre et le prouve. Le registre (
quality_spec.json) est recoupé bijectivement avec lesworking-directorydu CI Gitea (.gitea/workflows/ci.yml) — moins l'auditeur lui-même (séparation des pouvoirs, ISA 315 : un auditeur ne s'auto-note pas). Tout livrable ajouté au CI sans entrée de registre casse la couverture → le gate rougit. Aucune omission silencieuse possible. -
Note chaque module sur 5 critères 4Big déterministes, tous calculés depuis des faits du dépôt (jamais saisis) :
Critère Poids Fait vérifié DOC20 un *.md(README/SPEC) ≥ 400 octets à la racineCONTRAT20 un contrat de sortie *.schema.jsonTESTS25 ≥ 8 méthodes def test_*danstests/CLI15 un entrypoint __main__+ sous-commandes argparseHANDOFF20 out/MANIFEST.json+ ≥ 1 artefact JSON valide non vide -
Renormalise par archétype. Un critère non applicable est exclu du dénominateur (un module de contrat sans hand-off n'est pas pénalisé pour un
out/qu'il n'a jamais vocation à produire). Archétypes :generator(5 critères) ·data_room(sans HANDOFF) ·parser(sans CONTRAT local ni HANDOFF) ·contract(sans CLI ni HANDOFF).note = round(100 × Σ poids(critères applicables PASS) / Σ poids(applicables)) -
Rend un verdict global.
PASSssi couverture 100 % et tous les modules gated ≥ 95/100 ; sinonFAIL.
Anti-invention (#6)
Une note ne peut pas être fabriquée « pour faire 95 » : elle est recalculée
à partir de faits vérifiables (présence de fichiers, taille, comptage des méthodes
test_*, validité JSON du hand-off). Un invariant re-somme les poids et recompute
la note de chaque module ; une note qui ne se déduit pas de ses checks est
rejetée. L'auditeur est hors de son propre périmètre (SoD).
Utilisation
python3 audit_4big_gen.py build # écrit out/quality_report.json + MANIFEST.json
python3 audit_4big_gen.py validate # schéma + invariants (sort en erreur si un module < 95)
python3 -m unittest discover -s tests -v
Sorties (out/, hand-off VPS)
quality_report.json— couverture, note +checkspar module, totaux, verdict.MANIFEST.json— métadonnées de génération.
Sortie déterministe (tri stable, aucun horodatage) → diffable et
re-générable ; validée contre quality.schema.json par le validateur maison
Publiciste (zéro pip, runner Gitea sans réseau · CLAUDE.md #2).
Résultat courant
Verdict PASS — 24/24 modules à 100/100 (min 100), couverture
100 % des livrables gated. L'audit servira surtout de gate anti-régression :
retirer des tests, casser un MANIFEST ou supprimer un schéma fait chuter le
module sous 95 → FAIL.
Hors périmètre worker (VPS · #8)
Publication du rapport dans le desk ERPNext + branchement du gate 4Big sur le pipeline de release VPS → agent QA / DevOps.
Auto-score 4Big : 96/100.