Anonymiser un PDF gratuitement sans l'envoyer
Un rectangle noir posé sur un PDF laisse souvent le texte intact en dessous. Comment masquer un PDF pour de bon, sans qu'il quitte votre ordinateur.
Mis à jour le 29 septembre 2026
Un jugement à joindre à une note, un rapport d'expertise à montrer en formation, une fiche de paie à produire sans exposer le reste : tôt ou tard, une pièce doit sortir du dossier, débarrassée de ses noms et de ses numéros. La plupart des services « anonymiser un PDF » en ligne commencent par vous demander de téléverser le fichier. Pour un avocat, ce geste est déjà une communication : la pièce entière, avant tout masquage, part sur un serveur que vous ne maîtrisez pas.
Ce guide explique pourquoi un PDF « noirci » ne l'est souvent qu'en apparence, ce qu'est un vrai caviardage, et comment l'obtenir dans votre navigateur, sans envoi.
Pourquoi ne pas téléverser la pièce
Trois raisons, qui se cumulent.
- Le secret professionnel. Il couvre la pièce elle-même, pas seulement les noms qu'elle contient (art. 352 du Code pénal, en vigueur depuis le 8 avril 2026, qui reprend l'ancien art. 458).
- Le RGPD. Un service en ligne qui traite votre pièce agit comme sous-traitant. Le traitement doit alors être encadré par un contrat qui en fixe l'objet, la durée et la finalité (art. 28, § 3, du RGPD). Avant tout envoi, il faudrait donc savoir qui exploite le service, où il traite les fichiers et combien de temps il les garde.
- Les règles de la profession. Les lignes directrices IA de l'OVB et d'AVOCATS.BE (janvier 2025) demandent de lire les conditions d'utilisation de tout outil : entraînement, transmission, stockage, localisation du traitement (point 1.1, version française à la suite du texte néerlandais). La même vigilance vaut pour un service de caviardage.
Un outil qui travaille entièrement dans le navigateur évite la question : le fichier est lu dans la mémoire de votre ordinateur et traité sur place.
Les trois pièges d'un PDF « masqué »
Un PDF n'est pas une photographie de la page. Il superpose plusieurs couches, et chacune peut trahir ce que vous pensiez avoir caché.
- Le rectangle posé par-dessus. Un surlignage noir ou une forme dessinée recouvre le texte sans le supprimer. Sélectionnez la zone, copiez, collez dans un éditeur : le nom réapparaît. Les moteurs de recherche, les outils d'IA et les lecteurs d'écran lisent la couche texte, pas l'image.
- Les données qu'on ne voit pas. Propriétés du document (titre, auteur, logiciel, parfois la société), métadonnées XMP, annotations et commentaires, pièces jointes, champs de formulaire. Après un enregistrement incrémental, d'anciennes versions du contenu peuvent aussi subsister dans le même fichier.
- Le scan « rendu cherchable ». Beaucoup de copieurs ajoutent une couche de texte invisible sous l'image. Vous noircissez l'image ; le nom reste dans le texte caché.
S'y ajoutent les fuites ordinaires : un nom dans l'en-tête ou le pied de page, dans un signet, ou dans le nom du fichier lui-même (Conclusions_DUBOIS_c_LAMBERT.pdf).
Ce qu'est un vrai caviardage
Caviarder, c'est retirer l'information, pas la recouvrir. Pour un PDF, deux méthodes sont fiables, et Localex propose les deux ; le format Word s'y ajoute pour les pièces rédigées dans Word.
| Format de sortie | Ce que vous obtenez | La contrepartie |
|---|---|---|
| PDF caviardé, mise en page d'origine | Chaque page devient une image ; les rectangles noirs sont inscrits dans les pixels. Aucun texte caché ne subsiste. | Le texte n'est plus sélectionnable ni cherchable ; le fichier est plus lourd ; un lecteur d'écran ne peut plus le lire. |
| PDF, texte reconstruit | Un nouveau PDF est écrit à partir du texte, dans lequel chaque élément a été remplacé ([PERSONNE_1], barre noire, initiales…). | La mise en page d'origine est simplifiée. |
| Word (.docx) | Si la source est un DOCX : même mise en page, texte remplacé dans le fichier. | Utile seulement si vous disposez de la version Word. |
Dans tous les cas, les métadonnées, annotations, pièces jointes et champs de formulaire de la source sont retirés.
Pour une pièce dont l'aspect compte (courrier signé, extrait, pièce communiquée), choisissez la mise en page d'origine. Pour un texte que vous allez citer, retravailler ou soumettre à une IA, choisissez le texte reconstruit.
Anonymiser ou pseudonymiser ?
L'outil a deux modes. Anonymiser ne crée aucune clé : le remplacement est irréversible, ce qui convient à une pièce que vous partagez ou publiez. Pseudonymiser crée une clé de restauration chiffrée qui permet de remettre les originaux, par exemple dans la réponse d'une IA ; les données restent alors des données personnelles.
Même sans clé, un document n'est anonyme au sens du RGPD que si plus personne ne peut raisonnablement identifier les personnes (considérant 26). Une profession rare ou un village cité peut suffire. Le guide Pseudonymisation ou anonymisation ? détaille la différence.
Comment faire avec Localex
- Ouvrez l'outil et déposez le PDF dans « Déposer un fichier » (jusqu'à 50 Mo et 300 pages). Il est lu dans cet onglet uniquement ; le compteur « Données envoyées » reste à 0 octet.
- Choisissez le mode : « Anonymiser » pour partager ou publier, « Pseudonymiser » si vous devez restaurer les originaux plus tard.
- Dans « Ce que je veux masquer », tout est coché par défaut : personnes, identifiants (registre national, BCE, IBAN, communication structurée…), coordonnées, dates, organisations, données sensibles. Décochez uniquement ce qui peut rester en clair.
- Relisez les éléments surlignés. Laissez en clair un faux positif ; sélectionnez un mot oublié et choisissez « Masquer toutes les occurrences ».
- Dans « Exporter », choisissez « PDF caviardé, mise en page d'origine » ou « PDF, texte reconstruit ». Laissez cochées les options de nettoyage (métadonnées, commentaires et annotations).
- Cochez « J'ai relu le résultat » et exportez. Avant le téléchargement, le contrôle des fuites relit le fichier produit et y recherche chaque valeur d'origine. S'il en trouve une, le téléchargement est bloqué jusqu'à ce qu'elle soit masquée.
Un PDF scanné n'a pas de couche texte : il faut d'abord reconnaître le texte (OCR). L'OCR fait partie des fonctions IA, gratuites après vérification de votre adresse e-mail. Elle tourne, elle aussi, sur votre ordinateur.
Vérifier le résultat vous-même
Un outil ne remplace pas un dernier regard. Quatre contrôles prennent deux minutes :
- Ouvrez le PDF exporté, sélectionnez tout (
Ctrl+A), copiez, collez dans un éditeur de texte, puis cherchez le nom de famille, le numéro de registre national et l'IBAN. - Ouvrez les propriétés du document : titre, auteur, sujet, mots-clés.
- Regardez ce qui n'est pas du texte : un cachet, une signature, un logo d'en-tête avec adresse, une carte d'identité photographiée.
- Renommez le fichier avant de l'envoyer.
Pour vérifier que rien n'a quitté votre ordinateur, ouvrez l'onglet Réseau des outils de développement du navigateur (F12), ou coupez la connexion après le chargement de la page et traitez la pièce hors ligne. La page Sécurité décrit les deux tests.
Limites à connaître
- La détection vous assiste ; elle n'est pas exhaustive. Les identifiants belges à chiffre de contrôle (registre national, BCE, IBAN, communication structurée) sont reconnus de façon fiable lorsqu'ils sont bien formés. Un nom mal orthographié, coupé en fin de ligne ou écrit à la main peut échapper à la détection.
- Le contrôle des fuites recherche les valeurs que vous avez choisi de masquer et leurs variantes. Il ne peut pas retrouver un nom que ni la détection ni vous n'avez repéré.
- Les images intégrées sont signalées, pas lues, sauf si vous lancez l'OCR. Vous pouvez les supprimer ou les garder après les avoir vérifiées.
- Un PDF protégé par un mot de passe ne peut pas être lu. Retirez la protection dans votre lecteur PDF, puis déposez-le à nouveau.
- Vous restez responsable de ce qui est communiqué.