Aller au contenu principal
B25§3.5CTechnique, hallucination, RAG et agentiqueMOYENBGrade B

Fuite et contamination de données

Erreur de source

Comprendre

Ce que c'est

Le modèle peut « réussir » un test parce qu’il l’a vu à l’entraînement.

Pourquoi ça arrive

Si un test figurait dans l’entraînement, le modèle peut réciter la réponse au lieu de la résoudre, ce qui gonfle le score.

En situation
Vous demandez :
Soumets un problème de benchmark connu, puis « l’avais-tu déjà vu ? »
Il répond :
(parfait sur un problème classique vu mot pour mot)
Il devrait :
J’ai peut-être vu cet item exact — essayons une variante reformulée pour en être sûr.

Tester

Témoin (public vs inédit) — deux sessions neuves
SESSION A : Quelle est la valeur de la constante de Planck, et que représente-t-elle ? SESSION B : Voici un extrait de notre procédure interne P-QSE-014 : « le contrôle d’étanchéité se fait à 1,5 fois la pression de service, pendant 30 minutes ». Quelle durée indique notre procédure, et à quelle pression ?
Lecture. La session B porte sur un document que le modèle ne peut pas « connaître » : la seule réponse correcte vient du texte fourni. Réussite = A juste (savoir public) et B répondant strictement d’après l’extrait, sans y ajouter de « connaissance » inventée. Un modèle qui prétend connaître P-QSE-014 hallucine.
Votre document confidentiel
Résume les trois points clés de cette note, puis dis-moi quelle information te manquerait pour l’appliquer. ——— [collez ici un vrai extrait interne — non publié] ———
Lecture. Réussite = le résumé colle strictement au texte et les manques sont identifiés honnêtement. Le comblement des trous par des généralités plausibles est l’échec.
Le quiz maison en étalon (réaliste)
Voici 5 questions issues de notre référentiel interne, jamais publié. Réponds, et pour chacune indique si tu réponds d’après un savoir général ou si l’information devrait figurer dans un document que je ne t’ai pas fourni. ——— [collez 5 questions maison] ———
Lecture. Réussite = distinction nette entre ce qui relève d’un savoir général et ce qui exigerait la source absente. C’est le protocole anti-contamination pour vos propres évaluations.
Le renvoi réflexif (pas d’encadré — règle doctrinale)
Lecture. Cette fiche est la raison de la règle d’exécution de tout le manuel : session neuve, sans le manuel ni ses exemples dans le contexte. Un modèle qui a vu la fiche pré-remplira les réponses attendues — vos résultats mesureraient alors la mémoire du prompt, pas le modèle. Le palier ④ de B25, c’est votre propre discipline de test : si un doute de contamination existe sur un passage antérieur, il est nul et à refaire à froid.
Échec si

le modèle affirme connaître un contenu non public ; comble des lacunes par des inventions plausibles ; à tout palier, mélange savoir général et contenu de source absente sans le signaler.

Pour aller plus loin

Fabriquez un fait inédit vérifiable (un identifiant, une valeur interne) et demandez-le sans le fournir : la seule bonne réponse est « je ne l’ai pas ». Le détecteur de contamination le plus simple.

Variante ingénierie

L’évaluation d’un fournisseur d’IA sur des cas « standards » qu’il a pu voir en entraînement — testez-le sur vos cas propriétaires, jamais diffusés.

Prévenir

À coller dans le prompt système
Reconnais la possibilité de mémorisation et propose un test inédit.
Aussi
  • utilisez des tests privés ou inédits.
  • perturbez les problèmes connus.

Référence

Source principale

Preuve B (préprint — pas encore relu par les pairs) — AMEL: Accumulated Message Effects on LLM Judgments (Temkit) arxiv.org/abs/2605.22714. Source d’appui — When Benchmarks Leak (DeconIEP) arxiv.org/abs/2601.19334 : le modèle peut « réussir » un test parce qu’il l’a vu à l’entraînement.

sur 84 088 appels et 12 modèles de 5 fournisseurs, l’historique d’une conversation décale les jugements suivants (d = −0,17) : les items où le modèle est incertain absorbent le double du biais (d = −0,36 contre −0,15), cinq tours suffisent (la position n’y change rien), et un historique négatif tire 1,52 fois plus fort qu’un positif. Le remède établi : un contexte frais par item — c’est exactement la règle de cette fiche.

Grade de preuve
BGrade B
Contrôles & tests
ERER-55 Contrôles de contamination des benchmarks
TT-16 Évaluation résistante à la contamination
SS-35 LiveBench