Harness
Le harness est le harnais d’exécution qui encadre l’agent : ce qui exécute les outils, collecte les mesures et vérifie que le travail respecte le mandat.
Une instruction peut demander à un agent de ne pas pousser en production. Un guardrail peut lui retirer la permission. Le harness, lui, est l’ensemble du cadre dans lequel l’agent tourne : scripts, hooks, policies, tests, validations de sortie, permissions et mécanismes qui ne dépendent pas seulement de la bonne volonté du modèle.
Exemple
Un agent corrige un bug dans une boucle : il modifie le code, relance les tests, lit les erreurs, recommence.
Le harness peut :
- borner le nombre de tours ;
- exiger un checkpoint périodique ;
- séparer ce qu’il a observé (résultat des tests) de ce que l’agent déclare (hypothèses éliminées) ;
- signaler une stagnation sans juger à la place de l’humain.
À ne pas confondre
Un harness n’est pas un agent IA. Il ne décide pas à la place du modèle : il encadre, mesure et contrôle.
Ce n’est pas non plus qu’un guardrail isolé. Les guardrails protègent des limites critiques ; le harness organise l’exécution dans son ensemble — y compris la collecte de preuves et la validation de sortie.
Dans Golden Thread, le harness matérialise une partie du fil : ce qui rend le mandat praticable au quotidien.
À retenir
Le harness répond à une question différente de l’agent : pas « que faire ensuite ? », mais « dans quel cadre vérifiable cela s’exécute-t-il ? ».