Un confrère m'a transféré un dossier de quarante fichiers à faire relire par une IA. Statuts, pactes d'associés, courriels, tableaux de comptes. Le réflexe ? Ouvrir chaque document, masquer les noms à la main, passer au suivant. Sauf qu'au dixième fichier, sans même s'en rendre compte, on ne masque déjà plus tout à fait comme au premier, et l'IA, elle, ne devine jamais que « la société du fichier 3 » et « la société du fichier 28 » sont une seule et même partie. Le traitement par lot existe pour ça. On dépose le dossier entier, et chaque personne, chaque entreprise reçoit le même pseudonyme partout.
- Chaque fichier ouvert et masque separement
- Pseudonymes incoherents d'un fichier a l'autre
- Risque d'oubli sur un document du lot
- Long, donc souvent bacle
- Vous deposez plusieurs fichiers ensemble
- Tout le lot pseudonymisé d'un coup
- Pseudonymes cohérents entre les fichiers (même partie = même pseudonyme)
- Clé gardée, ré-identification a la fin
Le même nom devient le même pseudonyme, dans tous les fichiers
C'est le cœur du sujet. Quand vous pseudonymisez un lot d'un seul coup, Dupont devient PERSONNE_1 dans le contrat, dans le courriel et dans le tableau de comptes, exactement le même, du premier fichier au dernier. L'IA suit alors cette partie de document en document, compare ce qu'elle signe ici et ce qu'elle réclame là, sans jamais lire un vrai nom. Masquer chaque fichier dans son coin casse ce fil. La cohérence se perd. Et l'analyse croisée avec elle.
Sur un gros dossier, le volume est le vrai danger
Quarante fichiers à la main, c'est quarante occasions d'oublier quelque chose : une signature en bas de page, une adresse dans un en-tête, un nom glissé dans une note de marge. Plus le lot grossit, plus la relecture fatigue. Et plus elle laisse passer. Déposer tout le dossier ensemble change la donne, parce que la même détection s'applique au même niveau d'exigence sur chaque page, sans la moindre baisse d'attention au trentième document.
Attention au recoupement entre fichiers
Un détail anodin, pris isolément, ne dit rien. Recoupé avec un autre fichier du lot, il peut réidentifier une personne : une date dans l'un, une fonction dans l'autre, un montant dans le troisième. Traiter le dossier comme un ensemble cohérent, avec des pseudonymes stables d'une pièce à l'autre, ferme cette porte. Ce qui identifie dans un fichier identifie dans les autres. Donc c'est masqué partout, de la même façon.
La méthode, sur un dossier complet
Le geste est simple. Vous déposez tous les fichiers ensemble, le lot entier est pseudonymisé en une fois, puis vous travaillez avec l'IA sur la version masquée : synthèse, points de vigilance, comparaison entre pièces. Ensuite, vous ré-identifiez le livrable en local. La clé de correspondance, elle, ne bouge pas : elle reste chez vous, chiffrée, et rien ne part vers une IA tierce.
Safe-Doc fait exactement ça. Il traite plusieurs fichiers ensemble (PDF, Word, tableurs) avec des pseudonymes cohérents sur tout le lot, conserve la mise en page d'origine et traite vos documents en Union européenne avant de les purger. Pratique sur les gros dossiers. En due diligence, par exemple.
Déposez un dossier entier, d'un seul coup. Des pseudonymes cohérents sur toutes les pièces. La clé, gardée chez vous.