← Retour au plan
TrustLayer : lire et agir sur le badge de confiance · Leçon 1 sur 7

1. Qu'est-ce que le badge TrustLayer ?

Comprendre que chaque réponse de l'IA reçoit un score de confiance indépendant sur 100 avec un code couleur, et qu'il s'agit d'une aide à la lecture plutôt que d'un certificat de vérité.

Chaque fois qu'une IA génère une réponse sur OUPI, TrustLayer l'évalue de manière indépendante et affiche un badge. Ce badge indique un score sur 100 et une couleur :

Vert – tous les contrôles sont validés. • Orange – au moins un contrôle a soulevé un avertissement. • Rouge – un problème grave a été détecté.

Le badge est une aide à la lecture, pas un certificat de vérité. Il indique dans quelle mesure la réponse est cohérente avec les sources, votre demande et les outils utilisés — mais une affirmation cohérente avec ces éléments tout en étant fausse dans la réalité peut tout de même obtenir un score vert. Votre propre jugement reste essentiel pour les décisions et les engagements.

Derrière le score unique, TrustLayer exécute cinq contrôles indépendants :

  1. Ancrage aux sources – Les affirmations de la réponse se retrouvent-elles réellement dans les documents, bases de connaissances ou résultats web sur lesquels elle s'appuie ?
  2. Fidélité au prompt – La réponse couvre-t-elle ce que vous avez demandé et respecte-t-elle vos contraintes ?
  3. Revendications d'action – Lorsque l'IA affirme avoir effectué une action (envoyé, enregistré, recherché), cette action a-t-elle réellement eu lieu ?
  4. Garde-fou du code – Un code généré contient-il des schémas dangereux ?
  5. Répétition – Le modèle recycle-t-il le même contenu au lieu de produire une réponse nouvelle ?

Chaque contrôle contribue au score global et à la couleur. Vous pouvez cliquer sur le badge pour voir le résultat de chaque contrôle individuellement.

Toutes les réponses ne reçoivent pas un score. Les réponses conversationnelles courtes — comme « bien sûr, lequel ? » — ne contiennent aucune affirmation vérifiable. Les noter diluerait le sens du badge, c'est pourquoi TrustLayer les marque plutôt comme non applicable. Ainsi, lorsque vous voyez un score, vous savez que le système avait quelque chose de substantiel à évaluer.

Astuce

Un badge orange ou rouge est une invitation à vérifier, pas une raison de paniquer. Orange signifie qu'un contrôle a signalé quelque chose qui mérite d'être examiné (par exemple, une affirmation introuvable dans les sources). Rouge signale un problème grave, comme une action revendiquée mais jamais effectuée. Demandez à l'IA de citer ses sources, reformulez votre demande, ou joignez un document pour ancrer la réponse. Ne transmettez jamais une réponse au badge rouge sans l'avoir vérifiée au préalable.

Astuce

Vous souhaitez un score de confiance plus élevé ? Ancrez votre conversation. Lorsque vous joignez des documents ou connectez une base de connaissances, TrustLayer peut vérifier les affirmations par rapport à ces sources (ancrage aux sources). Des questions ouvertes et non ancrées laissent au système moins d'éléments auxquels s'ancrer, ce qui peut se traduire par des scores plus bas ou des contrôles moins décisifs.

À vous de jouer

Ouvrez un chat sur OUPI et posez une question factuelle — par exemple, demandez à l'IA de résumer un document que vous téléversez. Une fois la réponse affichée, repérez le badge TrustLayer. Cliquez dessus pour développer les détails : examinez chacun des cinq contrôles et notez lesquels ont été validés et lesquels ont soulevé des avertissements. Essayez de reformuler votre question ou d'ajouter une source pour voir comment le score évolue.

Suivre ce cours dans OUPI → Cet exercice se fait dans la plateforme OUPI.
À retenir

Chaque réponse de l'IA sur OUPI reçoit un badge TrustLayer : un score sur 100 avec une couleur verte, orange ou rouge. Cinq contrôles — ancrage aux sources, fidélité au prompt, revendications d'action, garde-fou du code et répétition — alimentent ce score. Les réponses conversationnelles courtes sont marquées non applicable. Vert ne signifie pas « vrai dans le monde réel » ; cela signifie cohérent avec les sources visibles, votre demande et les outils utilisés. Considérez l'orange et le rouge comme des invitations à vérifier, et ancrez vos questions avec des documents pour aider TrustLayer à donner le meilleur de lui-même.