Pour les décideurs

Situation

Les équipes livrent avec des LLM. La vitesse est là — les développeurs produisent du code plus vite qu’avant.

Complication

Sans discipline imposée, l’IA produit du code plausible mais non vérifié. La couverture de tests est déclarative, les revues sont superficielles, et la dette technique s’accumule silencieusement.

« The only way to go fast is to go well. » — Martin, R. C., Clean Architecture, 2017.

Question

Comment cadrer l’IA pour que la vitesse de livraison se traduise en valeur livrée ?

Réponse — Les 3 leviers SKRAFT

1. Discipline imposable

Chaque phase du pipeline applique le principe CQS : l’agent exécuteur écrit, le reviewer vérifie. Aucun agent ne valide son propre travail. Les invariants sont vérifiés automatiquement avant chaque transition de phase.

2. Métriques de qualité empiriques

SKRAFT mesure le Mutation Score, pas la couverture déclarative. Un test qui ne détecte pas de mutation est un test qui ne protège rien.

« Software delivery performance predicts organizational performance and profitability. » — Forsgren, N., Humble, J. & Kim, G., Accelerate, 2018.

3. Vitesse sans dette cachée

Le Walking Skeleton valide l’architecture de bout en bout avant d’écrire la moindre logique métier. L’Outside-In TDD garantit que chaque ligne de code est guidée par un test d’acceptation.

« High performers spend less time on unplanned work and rework, freeing capacity for new value. » — Forsgren, N., Humble, J. & Kim, G., Accelerate, 2018.

ROI mesurable — Métriques DORA

Métrique Sans pipeline Avec SKRAFT
Change Failure Rate Élevé — bugs découverts en production Réduit — validé par Mutation Score avant merge
MTTR Lent — diagnostic manuel Rapide — traçabilité issue → test → code
Deployment Frequency Freiné par la peur de casser Accéléré — chaque commit est vérifié

« If you only quantify one thing, quantify the cost of delay. » — Reinertsen, D. G., The Principles of Product Development Flow, 2009.

Limites actuelles et trajectoire

Le tableau des métriques DORA ci-dessus est une projection qualitative — pas un benchmark mesuré sur SKRAFT lui-même. La chaîne causale est ancrée dans la littérature établie (Forsgren et al., Wiegers), mais aucune étude contrôlée n’a encore mesuré l’impact de SKRAFT sur une équipe en production. Ces chiffres indiquent une direction, pas une garantie.

Garde-fous actifs (G1, G4, G5, G7, G8)

Cinq garde-fous sont opérationnels aujourd’hui. Ils font respecter l’ordre de dispatch, la structure des artefacts, les verdicts des reviewers et les écritures directes dans le fichier d’état au niveau du runtime — avant l’exécution de l’outil. Ces garde-fous sont mécaniques, pas consultatifs.

Garde-fous planifiés (G2, G3) et infrastructure (US6, US13)

Deux garde-fous ne sont pas encore actifs :

Prochain levier ROI mesurable

Le plus grand levier de coût non encore activé est le schéma de verdict hors-LLM : aujourd’hui le modèle formate les verdicts des reviewers, ce qui représente une taxe non négligeable sur la sortie des reviewers. Quand il sera implémenté, ce levier produira une réduction quantifiable de la dépense côté reviewers.

Ce que SKRAFT requiert