2. Les cinq contrôles expliqués
Identifier les cinq contrôles indépendants — ancrage aux sources, fidélité au prompt, revendications d'action, garde-fou du code et répétition — et comprendre ce que chacun vérifie.
Chaque réponse de l'IA sur OUPI est évaluée de manière indépendante par TrustLayer à travers cinq contrôles. Chaque contrôle vérifie une dimension différente de la fiabilité, et ils fonctionnent indépendamment les uns des autres — l'un peut être validé tandis qu'un autre soulève un avertissement. Ensemble, ils produisent un score unique sur 100 et une couleur (vert, orange ou rouge). Comprendre ce que chaque contrôle vérifie réellement vous aide à interpréter le badge et à savoir exactement où regarder lorsque quelque chose est signalé.
1. Ancrage aux sources — Lorsque la réponse de l'IA s'appuie sur des documents, des bases de connaissances ou des résultats web, ce contrôle vérifie si les affirmations de la réponse se retrouvent réellement dans ces sources. Si l'IA énonce un fait qui n'apparaît dans aucune source fournie, l'ancrage aux sources le signale. Cliquez sur le badge pour voir exactement quelles affirmations ont été confirmées et lesquelles ne l'ont pas été. Remarque : si aucune source n'est impliquée, ce contrôle n'a tout simplement rien sur quoi s'ancrer.
2. Fidélité au prompt — Ce contrôle vérifie que la réponse couvre ce que vous avez demandé et respecte les contraintes que vous avez fixées. Avez-vous demandé trois puces et reçu un paragraphe ? Avez-vous demandé un résumé de la section 2 mais reçu du contenu de la section 5 ? La fidélité au prompt détecte ces écarts. Elle garantit que l'IA est restée fidèle à la tâche par rapport à votre demande réelle.
3. Revendications d'action — Parfois, l'IA affirme avoir effectué une action : « j'ai envoyé l'e-mail », « le fichier a été enregistré », « j'ai effectué une recherche dans la base de données ». Ce contrôle compare ces actions revendiquées aux appels d'outils qui ont réellement eu lieu. Si l'IA affirme avoir fait quelque chose alors qu'aucune action correspondante n'a été exécutée, ce contrôle déclenche une alerte rouge. C'est l'un des contrôles les plus critiques — une fausse revendication d'action non détectée pourrait avoir des conséquences réelles.
4. Code guard — Lorsque l'IA génère du code, ce contrôle l'analyse à la recherche de schémas dangereux. Il agit comme un filet de sécurité avant que vous ne copiiez-colliez ou n'exécutiez quoi que ce soit. Si un extrait de code contient des constructions à risque, code guard signale ou marque la réponse afin que vous puissiez examiner le code attentivement avant de l'utiliser.
5. Répétition — Ce contrôle détecte lorsque le modèle recycle le même contenu au lieu de produire une réponse réellement utile. Le texte répété ou en boucle est un mode de défaillance connu des modèles de langage, et cette protection garantit que vous êtes alerté lorsque la réponse n'apporte pas de réelle valeur. Comme les autres contrôles, il contribue indépendamment au score global.
Rappel : un badge vert signifie que la réponse est cohérente avec les sources, votre demande et les outils utilisés — cela ne garantit pas que la réponse est vraie dans le monde réel. Votre jugement reste essentiel, en particulier pour les décisions et les engagements. Par ailleurs, les réponses conversationnelles courtes (comme « bien sûr, lequel ? ») sont marquées comme non applicables plutôt que notées, car il n'y a rien à vérifier.
TrustLayer effectue cinq contrôles indépendants sur chaque réponse de l'IA : (1) Ancrage des sources — les affirmations se trouvent-elles dans les sources fournies ? (2) Fidélité au prompt — la réponse correspond-elle à votre demande et à vos contraintes ? (3) Revendications d'actions — les actions revendiquées se sont-elles réellement produites ? (4) Code guard — le code généré est-il sûr ? (5) Répétition — le modèle recycle-t-il du contenu ? Chacun contribue au score sur 100. Cliquez sur le badge pour voir le détail par contrôle, et appliquez toujours votre propre jugement en complément.