← Retour au plan
TrustLayer : lire et agir sur le badge de confiance · Leçon 7 sur 7

7. TrustLayer dans le chat par rapport aux workflows automatisés

Distinguer le mode annotation seule dans le chat et les agents, du mode blocage dans les workflows automatisés, où un contrôle peut arrêter une sortie non vérifiée avant sa livraison.

TrustLayer fonctionne selon deux modes distincts selon l'endroit où l'IA travaille.

Mode annotation uniquement (discussion et agents) : Lorsque vous interagissez avec l'IA dans la discussion ou via des agents, TrustLayer note et annote chaque réponse — mais il ne bloque ni ne modifie jamais le résultat. Vous voyez le badge (vert, orange ou rouge), vous lisez les détails, et vous décidez de la marche à suivre. Le système vous fait confiance, à vous, l'humain dans la boucle, pour agir en fonction des avertissements.

Mode blocage (flux de travail automatisés) : Lorsque l'IA fonctionne sans surveillance — tâches planifiées, pipelines automatisés — personne ne surveille chaque résultat. Ici, un contrôle TrustLayer peut effectivement bloquer la livraison d'une réponse non vérifiée avant qu'elle n'atteigne sa destination. Cela empêche un flux de travail de publier ou d'envoyer un contenu présentant un problème de niveau rouge sans qu'aucune personne ne l'ait examiné.

La distinction clé : en discussion, vous êtes le filet de sécurité ; dans les flux de travail, TrustLayer devient le filet de sécurité.

Pourquoi le mode a-t-il de l'importance ? Prenons les cinq contrôles exécutés par TrustLayer — ancrage des sources, fidélité au prompt, affirmations d'action, contrôle du code et répétition. En discussion, si l'ancrage des sources signale une affirmation non ancrée (badge orange), vous pouvez immédiatement demander à l'IA de citer ses sources ou joindre un document. Vous vous adaptez en temps réel.

Dans un flux de travail automatisé, personne n'est là pour réagir. Si le contrôle des affirmations d'action détecte que l'IA a déclaré avoir envoyé un e-mail alors qu'aucun envoi n'a réellement eu lieu, ou si le contrôle du code repère un schéma dangereux dans du code généré, le mécanisme de blocage empêche ce résultat d'être mis en ligne. Sans cela, un rapport planifié pourrait silencieusement diffuser des données fabriquées ou du code dangereux.

Astuce

En discussion, considérez un badge orange comme une invite à enquêter — cliquez sur le badge, examinez quel contrôle a signalé le problème, et demandez à l'IA de reformuler ou de citer ses sources. Considérez un badge rouge comme un signal d'arrêt : ne transmettez jamais une réponse à badge rouge sans vérification manuelle. Dans les flux de travail, la plateforme applique cela automatiquement à votre place.

N'oubliez pas que les réponses conversationnelles courtes (par exemple, « bien sûr, lequel ? ») ne contiennent aucune affirmation vérifiable. TrustLayer les marque comme non applicables plutôt que de leur attribuer un score trompeur. Cela s'applique dans les deux modes — annotation et blocage — car il n'y a tout simplement rien à vérifier. Le badge reste pertinent en ne notant pas ce qui est trivialement vide.

Astuce

Un badge vert ne signifie pas « vrai dans le monde réel ». Il signifie que la réponse est cohérente avec les sources, la demande et les outils que TrustLayer peut observer. Même en mode blocage, un résultat ayant passé le contrôle vert pourrait contenir une erreur factuelle si la source sous-jacente était erronée. Votre jugement sur les décisions à fort enjeu reste essentiel quel que soit le mode.

À vous de jouer

Ouvrez une conversation en discussion et générez une réponse ancrée dans un document ou une base de connaissances. Cliquez sur le badge TrustLayer pour examiner le résultat de chaque contrôle. Puis imaginez que la même réponse s'exécute dans un flux de travail automatisé : aurait-elle été validée ou bloquée ? Cet exercice développe votre intuition sur les cas où l'annotation suffit et ceux où le blocage est essentiel.

Suivre ce cours dans OUPI → Cet exercice se fait dans la plateforme OUPI.
À retenir

En discussion et avec les agents, TrustLayer se contente d'annoter — vous voyez le score et la couleur, et vous décidez de la marche à suivre. Dans les flux de travail automatisés, TrustLayer peut bloquer un résultat non vérifié avant sa livraison, protégeant contre les erreurs non supervisées. Les réponses courtes sont marquées non applicables dans les deux modes. Le vert signifie cohérent en interne, pas objectivement vrai. Cliquez sur le badge pour voir les détails par contrôle, et appliquez toujours votre propre jugement sur les résultats critiques.