Faire trier une pile de CV par ChatGPT, c'est tentant, et beaucoup de recruteurs le font déjà. Mais deux problèmes se posent en même temps. D'abord le RGPD : un CV est plein de données personnelles (nom, age, adresse, telephone, parfois une photo) qui partent alors vers un service tiers. Ensuite la discrimination : si l'IA voit le nom, le genre suppose, l'age ou l'origine, elle peut reproduire des biais, exactement ce qu'un pre-tri est cense éviter. La CNIL surveille de pres l'usage de l'IA dans le recrutement. La bonne pratique : pseudonymiser les CV avant le pre-tri, pour que l'IA juge sur les competences, pas sur l'identité.
On masque ce qui peut biaiser le tri (nom, âge, adresse) ; on garde les compétences et l'expérience, seuls critères pertinents.
Le double risque : données personnelles et biais
Un CV envoye brut a une IA, c'est deux risques cumules. Cote données personnelles, vous exposez l'identité et les coordonnees de candidats qui n'ont rien demande, hors de votre contrôle. Cote equite, le nom, la photo, l'age ou l'adresse orientent le tri, même involontairement. Retirer ces éléments avant l'IA traite les deux d'un coup.
Ce qu'il faut retirer d'un CV avant l'IA
- Nom et prenom : le signal le plus fort de biais d'origine et de genre.
- Age et date de naissance : pour éviter le tri par age.
- Photo : a retirer, y compris quand le CV est un scan.
- Adresse et coordonnees : pour ne pas trier sur le lieu de vie.
- Indices indirects : nationalite, année d'obtention du diplome qui révèle l'age, etc.
La méthode, sans changer votre process
- 1. Pseudonymiser chaque CV : l'identité, les coordonnees, l'age et la photo deviennent des pseudonymes neutres.
- 2. Pre-trier avec l'IA sur la version masquée : l'IA classe sur les competences et l'expérience, pas sur l'identité.
- 3. Ré-identifier les candidats retenus en local, pour les contacter. La clé reste chez vous.
Le cadre : CNIL et RGPD
La CNIL rappelle que l'IA en recrutement doit rester loyale, transparente et non discriminante, et qu'une décision ne doit pas être entièrement automatisée sans intervention humaine. Pre-trier sur des CV pseudonymises réduit l'exposition des données de candidats et rend le tri plus explicable. Ce n'est pas une conformité a soi seul, mais c'est un pas concret du bon cote.
Les limites a garder en tete
- L'IA ne decide pas a votre place. Le pre-tri assiste, l'humain tranche. Une décision 100 % automatisée sur des personnes est encadree.
- La detection n'est pas parfaite. Aucun outil ne capte 100 % des cas, une relecture reste utile.
- Les CV scannes. Un CV en image contient du texte et une photo : il faut l'OCR et retirer la photo, sinon la fuite passe par l'image.
Pseudonymisation ou anonymisation ?
Pour le recrutement, vous voulez en général ré-identifier les candidats retenus après le pre-tri : c'est de la pseudonymisation (réversible, pseudonymes type PERSONNE_1, clé gardée de votre cote). L'anonymisation est irréversible, utile seulement si vous n'avez jamais besoin de retrouver l'identité. Mieux vaut savoir lequel on fait.
Safe-Doc pseudonymise les CV et dossiers du personnel avant l'IA, retire aussi la photo des CV scannes, et vous laisse ré-identifier les candidats retenus en local. Traitement en Union européenne puis purge, clé sous votre contrôle. Pour les détails du secteur, voir la page Safe-Doc pour les RH.
Testez sur une pile de CV, pseudonymisation réversible, tri centre sur les competences.