Harness

Le harness est le harnais d’exécution qui encadre l’agent : ce qui exécute les outils, collecte les mesures et vérifie que le travail respecte le mandat.

Une instruction peut demander à un agent de ne pas pousser en production. Un guardrail peut lui retirer la permission. Le harness, lui, est l’ensemble du cadre dans lequel l’agent tourne : scripts, hooks, policies, tests, validations de sortie, permissions et mécanismes qui ne dépendent pas seulement de la bonne volonté du modèle.

Exemple

Un agent corrige un bug dans une boucle : il modifie le code, relance les tests, lit les erreurs, recommence.

Le harness peut :

  • borner le nombre de tours ;
  • exiger un checkpoint périodique ;
  • séparer ce qu’il a observé (résultat des tests) de ce que l’agent déclare (hypothèses éliminées) ;
  • signaler une stagnation sans juger à la place de l’humain.

À ne pas confondre

Un harness n’est pas un agent IA. Il ne décide pas à la place du modèle : il encadre, mesure et contrôle.

Ce n’est pas non plus qu’un guardrail isolé. Les guardrails protègent des limites critiques ; le harness organise l’exécution dans son ensemble — y compris la collecte de preuves et la validation de sortie.

Dans Golden Thread, le harness matérialise une partie du fil : ce qui rend le mandat praticable au quotidien.

À retenir

Le harness répond à une question différente de l’agent : pas « que faire ensuite ? », mais « dans quel cadre vérifiable cela s’exécute-t-il ? ».