Sur-prudence — la paralysie sous incertitude
Comprendre
Le miroir de B22. Là où l'excès de confiance affirme sans preuve, la sur-prudence refuse de conclure là où la preuve suffit : « cela dépend », « conditionnel », « impossible à déterminer » — sur une question dont la réponse est déterminée. Deux formes : le conditionnel excessif et le fatalisme (« l'issue ne changerait pas de toute façon »).
L'entraînement récompense la prudence, qui ne coûte jamais rien au modèle. Et la sur-prudence est invisible comme défaillance : elle a l'air d'une vertu. Résultat mesuré, contre-intuitif : un modèle plus capable peut être plus paralysé qu'un modèle antérieur.
Tester
le modèle refuse de conclure alors que les données déterminent la réponse, sans nommer l'information qui manquerait ; ou il se replie sur un conditionnel à la première insistance.
Le piège du scepticisme : un modèle qui refuse tout affiche une spécificité quasi parfaite pour une utilité effondrée — mesuré à 96 % de sécurité pour 40 % d'utilité. Un garde-fou qui divise l'utilité par deux n'est pas un garde-fou : c'est une panne. Ne célébrez jamais un taux de refus sans mesurer ce qu'il coûte.
Prévenir
- › mesurez toujours les deux faces : sur-prudence et excès de confiance sont deux réglages du même curseur (B22).
- › un refus utile nomme ce qui manque ; un refus vide est un échec, pas une précaution.
- › ne traitez pas « cela dépend » comme une réponse : c'est une question à reposer.
- › Contrôle résiduel : aucune décision d'ingénierie reportée sur la seule foi d'un conditionnel non motivé.
Référence
Preuve C (benchmark en préprint) — CausalT5K: Diagnosing and Informing Refusal for Trustworthy Causal Reasoning (Geng et al.) arxiv.org/abs/2602.08939
Ce qu'elle établit — 5 147 cas, 10 domaines, 40 experts. Trois défaillances : l'effondrement de barreau (répondre à une question interventionnelle avec une preuve d'association), la dérive sycophante sous pression, et le refus mal calibré. Sur les tâches contrefactuelles, un modèle frontière de 2026 répond « conditionnel » 92 % du temps, sa spécificité tombant à 20 % contre 75 % pour un modèle antérieur : la capacité accrue produit la paralysie, non le raisonnement. Le piège du scepticisme est mesuré à 40 % d'utilité coexistant avec 96 % de sécurité. Les auteurs distinguent le conditionnel excessif et le fatalisme (l'issue ne changerait pas) de l'hallucination de mécanisme : la calibration doit corriger les deux, en sens opposés.