Meetup · Coding with AI · Juin 2026

SKRAFT
Pipeline

De l'issue au code mergé :
14 agents · 28 skills · 5 phases · 48 quality gates

14 agents 28 skills 5 phases 48 gates ~$29 / feature

Architecture

Les 5 phases du pipeline

DISCOVER
backlog-discovererexécuteur + reviewerindépendant

Triage issues
Sprint proposal

gate👤humain
DISCUSS
backlog-plannerexécuteur + reviewerindépendant

User stories
Acceptance criteria

gate👤humain
DESIGN
solution-architectexécuteur + reviewerindépendant

ADRs · DDD
Component diagram

gate👤humain
DISTILL
acceptance-designerexécuteur + reviewerindépendant

BDD scenarios
Test plan

gate👤humain
DELIVER
software-engineerexécuteur + reviewerindépendant

TDD · PR mergée
Quality gates

Agent exécuteur Agent reviewer indépendant 👤 Checkpoint humain entre chaque phase Chaque phase → verdict APPROVE ou RETRY / REJECT

Scénarios d'exécution

3 trajectoires possibles à travers les 5 phases

✅ IDÉAL
15-20%
Discover
Discuss
Design
Distill
Deliver
~40min~$15
⚠️ PROBABLE
70-75%
×1
Discover
Discuss
×1
Design
Distill
×1
Deliver
~60min~$29
❌ ERREUR
5-10%
Discover
Discuss
🛑STOP
Design
Distill
Deliver
Arrêt~$5+TTR
Approuvé du 1er coup Retry · relance reviewer ⟶ exécuteur 🛑Rejeté → escalade humaine Phase non atteinte

Contrôle qualité automatisé

Gates : ce qui bloque la propagation des erreurs

DISCOVERbacklog-discoverer-reviewer
completenessprioritizationduplicates
6gates
DISCUSSbacklog-planner-reviewer
investac-qualityplanning-coherencedor-compliance
8gates
DESIGNsolution-architect-reviewer
consistencyarchitecture-compliancefitness
15gates
DISTILLacceptance-designer-reviewer
coveragebusiness-alignmenttestabilityboundary-enforcement
8gates
DELIVERsoftware-engineer-reviewer · 4 sous-agents
architecture-boundariescold-readerquality-gatestest-integrity
11gates
Aucun agent ne valide son propre travail5 exécuteurs + 5 reviewers · 18 lentilles d'analyse · DELIVER spawn ses 4 lentilles en sous-agents adversariaux indépendants
48 gates

Mesures réelles — GitHub Actions PR #74

Tokens & itérations mesurés

PhaseModèles exec / reviewTokens in / outItérationsCoût ($1/1M tok)
DISCOVERsonnet-4.6 / haiku-4.5605K in / 4.2K out1$1.16
DISCUSSsonnet-4.6 / haiku-4.5802K in / 6.9K out1$1.42
DESIGNsonnet-4.6 / haiku-4.51.1M in / 11.4K out1$2.68
DISTILLsonnet-4.6 / haiku-4.5
1.2M / 10.7K🔍806K / 7.2K ✗660K / 4.5K🔍819K / 7.9K ✓
2+2$3.54
DELIVERsonnet-4.6 / haiku-4.5
1.4M / 7K ✗793K / 4K → 🔍 7.6M / 47K1.4M / 12K → 🔍 3M / 28K2.3M / 13K → 🔍 3.1M / 38K ✓Σ19.7M tokens
4+3$19.74
17runs d'agents pour cette feature (DISTILL ×4, DELIVER ×7)
~91%cache hit rate mesuré
$28.54coût total · $1/1M tokens Copilot
+$200création de SKRAFT · 80 h · ~20% du produit cible

Source : logs GitHub Actions PR #74 — juin 2026 · agent_usage.json par run · Coût one-shot de construction amorti sur toutes les features à venir

Fondations — la littérature du craft

Des grands principes, pas de l'improvisation

01 User Stories & INVEST Stories indépendantes, négociables, estimables, testables — découpées par la valeur « User Story Mapping »
Jeff Patton
02 Domain-Driven Design Bounded contexts, agrégats, langage ubiquitaire aligné sur le métier « Domain-Driven Design »
Eric Evans
03 Clean Architecture Dépendances dirigées vers le domaine, couches isolées, infrastructure remplaçable « Clean Architecture »
Robert C. Martin
04 Specification by Example BDD Gherkin : les exemples deviennent des spécifications exécutables « Specification by Example »
Gojko Adzic
05 Outside-In TDD RED→GREEN→REFACTOR, design émergent, Object Calisthenics sur le domaine « Growing Object-Oriented Software »
Freeman & Pryce
Chaque agent encode des décennies de discipline d'ingénierie28 skills encodent ces principes, appliqués par 14 agents et vérifiés par les lentilles des reviewers — la rigueur ne dépend plus de la disponibilité d'un senior
5 livres

Discipline d'ingénierie — exécutée à chaque feature

Tout ce que SKRAFT n'oublie jamais

Spécification INVEST appliqué aux stories Definition of Ready — 8 points Critères d'acceptation vérifiables Scénarios BDD Gherkin G/W/T
Architecture ADRs tracés & ratifiés habituellement rarement fait Clean Architecture G1-G15 habituellement jamais fait DDD bounded contexts habituellement jamais fait
Tests Outside-in TDD (RED→GREEN→REFACTOR) Tests unitaires + acceptance Mutation testing : 100% Domain/App Architecture conformance tests
Code & Process Object Calisthenics habituellement jamais fait Revue adversariale indépendante 0 auto-validation · 14 agents Traçabilité complète issue → merge
🧬 Mutation testing — rarement fait à la main, systématique ici Sous pression, un dev coupe la qualité d'abord sur le mutation testing. SKRAFT le rejoue à chaque feature : 100% sur Domain & Application, seuil ≥60% sur les autres couches. Il vérifie que les tests tuent vraiment les régressions, pas qu'ils passent. 100%Domain / App≥60%autres couches
48 / 48gates exécutés — jamais sautés sous deadline
+70%de la revue déjà faite par les gates → accélère le dev
~$29par feature · discipline complète · $1/1M tokens

Conclusion

SKRAFT rend la qualité systématique

📋TraçabilitéChaque décision archivée : ADRs datés, artefacts versionnés, state.json auditable à tout moment
🛡️Non-régressionLes gates bloquent avant que l'erreur ne descende — jamais de mauvais artefact en aval
🔄Itération bornéeMax 2 retries par phase, escalade propre si rejet — pas de boucle infinie, toujours une sortie
14 agents5 exécuteurs + 9 reviewers indépendants
28 skillsdiscipline du craft encodée & réutilisable
~$29coût LLM par feature · $1/1M tok
~60 minissue → code mergé
0auto-validation — reviewers toujours indépendants