IA responsable5 min de lecture

Un score de confiance n'est pas une preuve

Un score de confiance généré par un modèle n'est pas une preuve. Remplacez-le par quatre niveaux de preuve pour visualiser les sources, vérifications, lacunes et limites.

Bokili Editorial· Vérifié le 22 août 2026
PartagerX
Une personne remplace un score de confiance IA par quatre états de preuve reliés aux sources

Demandez à une IA son niveau de confiance, elle vous donnera peut-être un pourcentage. Ce chiffre semble quantifiable. Pourtant, en contexte professionnel, il s'agit le plus souvent de texte généré, et non d'une probabilité vérifiée. Sans évaluation et calibrage du système pour la tâche, le modèle et les conditions d'utilisation, un « confiant à 92 % » ne signifie pas qu'une réponse a 92 % de chances d'être correcte.

C'est important, car un chiffre peut clore le débat. Une note de marché, un résumé fournisseur ou une réponse politique bien rédigés semblent plus fiables avec un score précis, même si ce score vient du même processus qui a produit l'affirmation. La démarche la plus sûre est simple : ignorer les scores de confiance non étayés et qualifier la preuve derrière chaque affirmation clé.

Pourquoi calibrer le score de confiance

Le calibrage est la corrélation entre la confiance affichée et la performance observée. Si un système attribue 80 % de confiance à de nombreuses réponses, environ 80 % d'entre elles doivent être correctes dans les conditions évaluées. Cette corrélation doit être testée sur des tâches représentatives. Elle ne peut être créée en ajoutant simplement « donnez un score de confiance » à un prompt.

La recherche montre l'importance de cette distinction. Une étude de l'ACL (2024) a testé six méthodes de prompting pour répondre à des questions ; elle a montré que le prompt pouvait altérer le calibrage tout en générant un excès de confiance dans certains cas. Un benchmark clinique open-access (2026) a testé 48 modèles sur 300 questions de gastro-entérologie et a révélé une faible auto-estimation. Les auteurs insistent sur la supervision humaine. Ce benchmark est spécifique à un domaine et ne prouve pas que tous les modèles se comportent de la même façon sur toutes les tâches. C'est un avertissement concret : ne traitez pas la confiance verbalisée comme une fiabilité validée.

Score de confianceÉtat de preuve
Ce qu’il décritLa certitude exprimée par le modèle dans un texte généréCe qu’une personne peut réellement retrouver ou vérifier
Ce qui le rend fiableDes données de calibrage propres à la tâcheDes sources, des contrôles indépendants et des lacunes visibles
Action attendueSouvent floue ou fondée sur un seuil arbitraireVérifier, résoudre, limiter l’usage ou arrêter
Ce qui reste visibleUn score uniqueLa raison pour laquelle une affirmation peut ou non être utilisée

Remplacez le score par quatre niveaux de preuve

Les quatre états de preuve SAFE

1

Étayer par une source

Une source nommée et accessible soutient directement l’affirmation importante. La personne chargée de la vérification l’a ouverte et a contrôlé le contexte.

2

Assurer par un contrôle

Une personne ou une méthode indépendante a vérifié l’affirmation avec une seconde source fiable, un calcul, un jeu de données ou un registre approuvé.

3

Signaler

L’affirmation semble plausible, mais la source manque, reste ambiguë, est obsolète ou contredite. Elle ne doit pas être présentée comme un fait établi.

4

Exclure

La question dépasse les preuves, données autorisées ou compétences disponibles. Le workflow s’arrête ou est transmis au bon responsable.

SAFE n'est pas un nouveau score de modèle. C'est un langage de statut de travail. Une affirmation peut passer de Signalé à Sourcé après ouverture d'une source, ou de Sourcé à Assuré après une vérification indépendante. Exclu n'est pas un échec ; cet état rend une limite visible avant que quelqu'un ne comble le vide par une supposition.

Exemple pratique : le résumé fournisseur confiant

Lire, c'est bien. Pratiquer, ça change tout.

Commencer

Imaginons qu'une équipe opérationnelle demande à un assistant de comparer deux fournisseurs à partir d'informations publiques. Le brouillon indique que le Fournisseur A a de meilleurs antécédents de livraison et affiche « confiance à 92 % ». La réviseure ne débat pas pour savoir si 92 devrait être 85. Elle supprime le chiffre et qualifie les affirmations sous-jacentes.

Vérification des preuves dans le brouillon

  • Étayer : la zone de service publiée et le délai annoncé par chaque fournisseur.
  • Assurer : les tarifs actuels contrôlés dans le devis signé et le registre financier.
  • Signaler : l’affirmation selon laquelle le fournisseur A aurait moins de retards, faute de données comparables.
  • Exclure : la recommandation sur le risque contractuel, qui exige l’avis des achats et du juridique.
  • Décision : le brief ne peut alimenter la présélection qu’après retrait ou justification de l’affirmation signalée.

Le résultat est plus utile qu'un score de confiance. Il montre quelles affirmations sont prêtes, lesquelles nécessitent du travail et lesquelles relèvent d'un autre responsable. Il crée aussi un historique de révision qu'un collègue peut comprendre sans reproduire toute la conversation.

Ne faites pas de SAFE un autre score caché

Les quatre états ne doivent pas être réduits à un pourcentage unique ni servir à récompenser la production d'étiquettes vertes. Le profil sur l'IA générative du NIST traite la fiabilité comme un élément que les organisations gèrent de la conception à l'évaluation, en passant par l'usage. En pratique, cela signifie préserver le contexte : l'enjeu de la tâche, la qualité des sources, les limites des données, la compétence du réviseur et le coût d'une erreur.

Garde-fous pour les managers

  • Définir quelles affirmations sont assez importantes pour être qualifiées.
  • Exiger l’ouverture de la source, pas seulement sa mention.
  • Ajouter un second contrôle lorsqu’une erreur peut toucher l’argent, les droits, la sécurité ou la réputation.
  • Nommer la personne qui peut résoudre un élément signalé ou exclu.
  • Conserver les preuves d’origine avec le livrable final.
  • Ne jamais utiliser un score de confiance généré comme seule règle d’approbation.

Liez la méthode aux contrôles existants

SAFE complète les guides Bokili pour vérifier une réponse d’IA, définir une règle d’arrêt, mener une clinique des risques d’un workflow et transmettre un travail assisté par IA. Utilisez les états de preuve dans ces workflows plutôt que de créer un système d’approbation parallèle.

Remplacer un score de confiance en dix minutes
  1. Choisissez un brief IA à faible risque contenant trois ou quatre affirmations factuelles.
  2. Supprimez tout score de confiance produit par le modèle.
  3. Ouvrez les sources et qualifiez chaque affirmation : étayée, assurée, signalée ou exclue.
  4. Écrivez l’action requise pour chaque élément signalé ou exclu.
  5. Demandez à un collègue si les états rendent la prochaine décision plus claire.
  6. Conservez les états avec le brief relu, pas uniquement dans la conversation.

La précision est précieuse lorsqu'elle repose sur des preuves et une évaluation. Un pourcentage sans calibrage ne fait qu'imiter cette précision. Donnez aux réviseurs un statut qu'ils peuvent inspecter, une source qu'ils peuvent ouvrir et une limite sur laquelle ils peuvent agir.

Sources

  1. Artificial Intelligence Risk Management Framework: Generative Artificial Intelligence ProfileNIST
  2. Fact-and-Reflection (FaR) Improves Confidence Calibration of Large Language ModelsAssociation for Computational Linguistics
  3. Across generations, sizes, and types, large language models poorly report self-confidence in gastroenterology clinical reasoning tasksnpj Gut and Liver
PartagerX

Lire, c'est bien. Pratiquer, ça change tout.

Bokili transforme ce type de compétence en missions de dix minutes pour toute l'équipe, avec un retour immédiat et une progression visible.

Commencer

À lire ensuite

Un document généré par l’IA et erroné passe par le diagnostic, la correction et la vérification avant validation humaine.
Perspectives5 min de lecture

La maîtrise de l'IA commence à la première erreur

La vraie maîtrise de l'IA ne se mesure pas à la perfection d'une première réponse, mais à la capacité de détecter une erreur, la corriger et valider le résultat.