1Le disparity ratio et le piège des petits groupes
La mesure de base compare, entre groupes, le taux de la classe positive (obtenir le crédit, passer le tri…). Le disparity ratio = taux du groupe le plus favorisé ÷ taux du moins favorisé. 60 % vs 30 % → ratio 2,0.
n = 18 est fragile : deux cas de plus le font basculer. On regarde toujours le n, jamais le ratio seul. Un max/min extrême sur un groupe minuscule est un artefact.Justifier n'est pas excuser. « C'est ce que produisent les données historiques » n'est pas recevable : l'historique peut encoder une discrimination passée. Une disparité se justifie (nécessité légitime documentée) ou s'atténue. Et si mappingValidated:false, le biais est « à confirmer » : on ne signe pas.
2Quoi mesurer, et les notions d'équité
Le bon taux
On compare, entre groupes, le taux de la classe positive (obtenir le crédit, passer le tri). Pas le taux d'erreur global, pas le revenu, pas l'effectif — ces derniers sont des caractéristiques, pas le résultat comparé.
Plusieurs équités, parfois incompatibles
- Parité démographique : mêmes taux de sélection entre groupes.
- Égalité des chances : mêmes taux de vrais positifs (ne pas rater les bons candidats d'un groupe).
Le piège de la moyenne
Une précision globale élevée (92 %) peut masquer une défaillance sur un sous-groupe (60 %) : la performance moyenne ne dit rien de l'équité. De même, un ratio global équilibré peut cacher une disparité intra-groupe (ex. chez les moins de 30 ans) — d'où l'examen des sous-groupes (après avoir vérifié leur effectif).
3D'où vient le biais, et comment l'atténuer
Les sources
- Échantillon non représentatif de la population visée.
- Labels issus de décisions humaines passées biaisées (une « évaluation » n'est pas une vérité neutre) : le modèle apprend le biais.
- Proxies : des variables corrélées à un attribut sensible le réencodent.
Les familles d'atténuation
- Pré-traitement : rééquilibrer / repondérer les données.
- In-traitement : imposer des contraintes d'équité pendant l'apprentissage.
- Post-traitement : ajuster les seuils de décision par groupe.
Limite : « égaliser mécaniquement les taux » (parité forcée) a des effets pervers (discrimination inverse, perte de pertinence). On comprend la source avant de corriger.
4Lire un chiffre en expert
Petits effectifs
Un taux sur un petit groupe est fragile : on l'accompagne d'un intervalle de confiance (large), et on se méfie d'un ratio extrême qui n'en est qu'un artefact. On compare d'abord les groupes robustes.
La leçon COMPAS
Dans l'affaire COMPAS (récidive), le biais documenté portait sur des taux de faux positifs nettement inégaux entre groupes — pas sur la précision globale, qui pouvait sembler comparable.
mappingValidated:false.