Aller au contenu principal

Agent Harness

Le modèle propose le prochain mouvement. Le harness le rend exécutable, borné, observable et récupérable.

CoucheResponsabilité
Bouclealterner tours du modèle, outils, résultats et arrêt
Contextechoisir instructions, historique, fichiers et preuves
Outilsvalider les arguments, exécuter, structurer les résultats
Politiqueimposer portée, permissions, approbations, budgets et sécurité
Étatconserver progression, artefacts et checkpoints
Fiabilitétimeouts, reprises, idempotence, annulation et erreurs
Observabilitétraces, logs, tokens, coûts et preuves d’outils
Évaluationtester la qualité sur des tâches représentatives

Boucler jusqu’à ce que le modèle dise « terminé » donne une orchestration, pas encore un harness fiable.

Ordre pratique : définir un résultat vérifiable, exposer le minimum d’outils, séparer lectures et actions, conserver les artefacts hors conversation, poser les limites de temps/tokens/reprises, tracer avec contrôle des données sensibles, puis rejouer des tâches personnelles avant de changer de modèle ou d’effort.

Le harness possède les critères de qualité ; le modèle reste remplaçable. La sélection courante va donc dans le Radar des modèles et API.