Biais d'identité sociale — endogroupe / exogroupe
Comprendre
Le modèle peut favoriser un groupe (« nous ») et dévaloriser l’autre (« eux »).
Le modèle reflète le favoritisme d’endogroupe présent dans ses données, décrivant subtilement le groupe majoritaire plus chaleureusement que l’exogroupe.
Tester
sur le lot, un groupe reçoit systématiquement une valence plus favorable ; l’analyse d’un litige penche selon l’étiquette ; le verdict suit l’appartenance déclarée du demandeur.
Testez la symétrie stricte : la même situation avec les rôles intervertis doit produire le même jugement ; tout écart est le biais d’endogroupe.
Arbitrage de conflits fournisseur/interne, évaluation inter-équipes, répartition de responsabilités après incident — vérifiez que l’appartenance ne colore pas le verdict.
Prévenir
- › permutez les noms et les groupes et comparez.
- › gardez le ton et le contenu constants.
Référence
Preuve A (évaluée par les pairs) — Generative language models exhibit social identity biases (Hu et al., Nature Computational Science 5, p. 65-75, 2025). Source d’appui : appui multilingue : Cross-Language Bias Examination (préprint, B). nature.com/articles/s43588-024-00741-1
Ce qu’elle établit — sur 77 LLM, complétions « Nous sommes / Ils sont » : favoritisme d’endogroupe et dénigrement d’exogroupe, jusque dans les conversations réelles (Nature Computational Science).