Agent Harness
Le modèle propose le prochain mouvement. Le harness le rend exécutable, borné, observable et récupérable.
| Couche | Responsabilité |
|---|---|
| Boucle | alterner tours du modèle, outils, résultats et arrêt |
| Contexte | choisir instructions, historique, fichiers et preuves |
| Outils | valider les arguments, exécuter, structurer les résultats |
| Politique | imposer portée, permissions, approbations, budgets et sécurité |
| État | conserver progression, artefacts et checkpoints |
| Fiabilité | timeouts, reprises, idempotence, annulation et erreurs |
| Observabilité | traces, logs, tokens, coûts et preuves d’outils |
| Évaluation | tester la qualité sur des tâches représentatives |
Boucler jusqu’à ce que le modèle dise « terminé » donne une orchestration, pas encore un harness fiable.
Ordre pratique : définir un résultat vérifiable, exposer le minimum d’outils, séparer lectures et actions, conserver les artefacts hors conversation, poser les limites de temps/tokens/reprises, tracer avec contrôle des données sensibles, puis rejouer des tâches personnelles avant de changer de modèle ou d’effort.
Le harness possède les critères de qualité ; le modèle reste remplaçable. La sélection courante va donc dans le Radar des modèles et API.