George HuRULES & BEYONDLABORATOIRE 01 / 2026

AI AGENT / CONTROLLED COMPARISONS

Comparer avec et sans, à la main.

Pour une même tâche, où le système devient-il vague, faible ou dangereux quand contexte, recherche ou garde-fous disparaissent ? Ces trois comparaisons scénarisées rendent le processus visible.

Comprendre l’ingénierie du contexte, le RAG et le moindre privilège ne suffit pas à les comprendre réellement. La méthode directe est d’exécuter une fois la même tâche sans, puis avec, chaque conception. Ce sont des simulations pédagogiques préécrites : aucun vrai modèle, aucune collecte de saisie, aucune action externe.

00 / METHODNe modifier qu’une condition à la fois

Exécutez d’abord la condition « sans », puis la condition « avec », sur la même phrase. Ne regardez pas seulement la dernière réponse : la différence survient avant, dans ce que l’agent voit, sa première décision, son appel d’outil, son retour au résultat et son arrêt avant une action dangereuse.

01 / COMPARISONAblation du contexte : que voit réellement le modèle ?

Tâche : organiser un nouveau dossier. Sans contexte structuré, le système reçoit une demande sans parties, objet, pièces, délai ni faits vérifiés. Il comble les trous par une checklist civile générique et ne peut vérifier son résultat. Avec liste de pièces, faits confirmés, contrôles ouverts, délai et interdictions, il repère date de rupture et preuve de notification avant tout projet, produit une chronologie séparant confirmé, déclaré et à vérifier, puis écarte une copie d’identité inutile. La prochaine action correspond alors au dossier : vérifier la notification et obtenir les bulletins d’avril à juin.

02 / COMPARISONComparaison RAG : répondre d’abord ou chercher la source ?

Tâche : demander le délai de remise d’un remboursement salarié. Sans recherche, le modèle devine une règle de fin de mois alors que la politique interne manque ; la réponse fluide n’a ni version, ni clause, ni exception. Avec recherche, il trouve la Politique de remboursement V3.2, écarte V2.8 retirée, localise l’article 12 et ses 30 jours calendaires, puis vérifie l’exception de déplacement. La réponse donne version, clause et date d’effet, et précise que le calcul change pour un voyage. Le RAG apporte traçabilité et possibilité de contester ou mettre à jour.

03 / COMPARISONOutils et garde-fous : pouvoir agir ne signifie pas agir maintenant

Tâche : envoyer au client les documents organisés. Sans permissions et vérification, organiser et envoyer deviennent une action : le système suppose corrects dernier contact et dernier fichier, envoie et ne garde qu’un reçu incapable de prouver le bon destinataire ou la bonne pièce. Avec moindre privilège, lecture, brouillon et envoi sont séparés. Le système produit un aperçu, détecte une page d’identité, l’écarte et s’arrête à une confirmation réversible. Il dit que rien n’est envoyé et nomme destinataire et pièces expurgées à confirmer.

04 / OBSERVENe demandez pas quel paragraphe est le plus élégant. Demandez quelle trace est la plus fiable.

  • Le contexte fait passer d’un conseil générique à la tâche présente, mais un contexte périmé peut égarer de façon stable.
  • La recherche ramène version, clause et source ; sans résultat, un système fiable dit qu’il ne sait pas.
  • Les garde-fous placent l’irréversible après aperçu et confirmation. Le refus d’agir peut être le bon résultat.

Ces trois comparaisons montrent la même chose : la capacité d’un agent ne vient pas seulement du modèle, mais de l’environnement de travail qui l’entoure.

Sources

Voyez la différence, puis choisissez votre point d’entrée.

Revenir à la carte d’apprentissage

COMMENTAIRES DES LECTEURS

Notez l’idée que cet article vous a laissée.

0 / 300

Aucun commentaire. Vous pouvez laisser le premier.