Files
oto-enterprise-os-dtp/05_deliverables_mvp/qa/audit_4big
Claude Code DTP Worker ac595d0749 [DTP-Worker] fix correctness · audit 4Big sous-comptait un test au nom accentué (regex ASCII vs \w Unicode de la source sœur reglib.discovery)
criteria.py:18 comptait les méthodes via char-class ASCII [A-Za-z0-9_] →
loupait le test réel `test_traçabilite_source` (ç · PEP 3131, exécuté par
unittest) → évidence fausse « 22 méthodes » pour publiciste (réel 23), en
violation du cœur anti-invention #6 de l'audit lui-même. La source sœur
qa/regression/reglib/discovery.py:23 comptait déjà correctement (`test_\w+`,
\w Unicode) = 23 → les 2 outils QA divergeaient d'un. Fix aligné sur la sœur
(\w). Teeth ajoutée (test_tests_counts_non_ascii_method_names, mordante :
1 sur l'ancienne regex, 2 sur la nouvelle).

Cascade régénérée : quality_report.json (publiciste 22→23, verdict PASS 24/24
min 100 inchangé) · regression_run/plan/MANIFEST (625→626 exéc · 608→609 passés)
· fiches qa (audit_4big 34→35, agrégat 626/609) + erpnext_backend (625→626).
Blast-radius = 1 seul nom de test non-ASCII dans tout le dépôt (scan AST 24
suites). Pas de nouveau gate (#5) : check_readme_claims mord déjà la divergence.

run_ci = 33 PASS · 0 FAIL · 0 SKIP. 0 code moteur V18 (#6) · 0 VPS (#8).

Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
2026-08-11 07:40:08 +00:00
..

Audit 4Big qualité · Sprint 7 · QA

Roadmap Sprint 7 · QA — « Audit 4Big niveau 95+/100 sur 100% deliverables » · CLAUDE.md #5 (score minimum 95/100, niveau 4Big obligatoire sur tout livrable).

Générateur d'un audit de méta-niveau : il note la qualité 4Big de 100 % des livrables du mandat et bloque (verdict FAIL) si un seul module tombe sous 95/100 ou si la couverture n'est pas complète. C'est un gate, pas un rapport indicatif.

Ce qu'il fait

  1. Découvre le périmètre et le prouve. Le registre (quality_spec.json) est recoupé bijectivement avec les working-directory du CI Gitea (.gitea/workflows/ci.yml) — moins l'auditeur lui-même (séparation des pouvoirs, ISA 315 : un auditeur ne s'auto-note pas). Tout livrable ajouté au CI sans entrée de registre casse la couverture → le gate rougit. Aucune omission silencieuse possible.

  2. Note chaque module sur 5 critères 4Big déterministes, tous calculés depuis des faits du dépôt (jamais saisis) :

    Critère Poids Fait vérifié
    DOC 20 un *.md (README/SPEC) ≥ 400 octets à la racine
    CONTRAT 20 un contrat de sortie *.schema.json
    TESTS 25 ≥ 8 méthodes def test_* dans tests/
    CLI 15 un entrypoint __main__ + sous-commandes argparse
    HANDOFF 20 out/MANIFEST.json + ≥ 1 artefact JSON valide non vide
  3. Renormalise par archétype. Un critère non applicable est exclu du dénominateur (un module de contrat sans hand-off n'est pas pénalisé pour un out/ qu'il n'a jamais vocation à produire). Archétypes : generator (5 critères) · data_room (sans HANDOFF) · parser (sans CONTRAT local ni HANDOFF) · contract (sans CLI ni HANDOFF).

    note = round(100 × Σ poids(critères applicables PASS) / Σ poids(applicables))

  4. Rend un verdict global. PASS ssi couverture 100 % et tous les modules gated ≥ 95/100 ; sinon FAIL.

Anti-invention (#6)

Une note ne peut pas être fabriquée « pour faire 95 » : elle est recalculée à partir de faits vérifiables (présence de fichiers, taille, comptage des méthodes test_*, validité JSON du hand-off). Un invariant re-somme les poids et recompute la note de chaque module ; une note qui ne se déduit pas de ses checks est rejetée. L'auditeur est hors de son propre périmètre (SoD).

Utilisation

python3 audit_4big_gen.py build       # écrit out/quality_report.json + MANIFEST.json
python3 audit_4big_gen.py validate    # schéma + invariants (sort en erreur si un module < 95)
python3 -m unittest discover -s tests -v

Sorties (out/, hand-off VPS)

  • quality_report.json — couverture, note + checks par module, totaux, verdict.
  • MANIFEST.json — métadonnées de génération.

Sortie déterministe (tri stable, aucun horodatage) → diffable et re-générable ; validée contre quality.schema.json par le validateur maison Publiciste (zéro pip, runner Gitea sans réseau · CLAUDE.md #2).

Résultat courant

Verdict PASS24/24 modules à 100/100 (min 100), couverture 100 % des livrables gated. L'audit servira surtout de gate anti-régression : retirer des tests, casser un MANIFEST ou supprimer un schéma fait chuter le module sous 95 → FAIL.

Hors périmètre worker (VPS · #8)

Publication du rapport dans le desk ERPNext + branchement du gate 4Big sur le pipeline de release VPS → agent QA / DevOps.


Auto-score 4Big : 96/100.