Éditeur de métadonnées PDF, modifier ou supprimer les propriétés
Modifiez le titre, l'auteur, le sujet, les mots-clés et les dates d'un PDF, ou supprimez-les entièrement. Tout se passe dans votre navigateur, sans téléversement.
Chargement de Éditeur de métadonnées PDF, modifier ou supprimer les propriétés… Si rien ne se passe, activez JavaScript.
Chaque PDF transporte un petit bloc d'informations sur lui-même, distinct du texte de ses pages : un titre, un auteur, une ligne de sujet, une liste de mots-clés, le nom de l'application dans laquelle il a été rédigé, le nom du logiciel qui a produit le PDF, et des horodatages de création et de dernière modification. C'est le dictionnaire d'informations du document, et c'est ce que votre système d'exploitation affiche dans le panneau Propriétés d'un fichier, ce qu'un lecteur PDF place dans sa barre de titre, et ce que les moteurs de recherche et les systèmes de gestion documentaire lisent lorsqu'ils indexent un fichier. Cet outil charge ce bloc depuis le PDF que vous choisissez, vous laisse modifier chaque champ, puis écrit une nouvelle copie du fichier avec vos valeurs.
Questions fréquentes
Mon PDF est-il téléversé quelque part ?
Quelles métadonnées un PDF contient-il réellement ?
Comment supprimer toutes les métadonnées d'un PDF ?
Modifier les métadonnées change-t-il les pages ou la qualité du PDF ?
Pourquoi la taille du fichier change-t-elle légèrement après enregistrement ?
L'outil indique que mon PDF est chiffré. Que faire ?
Quelle est la différence entre Créateur et Producteur ?
Comment saisir les mots-clés ?
Les moteurs de recherche utiliseront-ils le titre que je définis ?
Modifie-t-il aussi les métadonnées XMP ?
À propos de Éditeur de métadonnées PDF, modifier ou supprimer les propriétés
Deux raisons courantes justifient de s'y intéresser. La première relève de la présentation et de la découvrabilité : un rapport dont le champ de titre indique encore "Microsoft Word - sanstitre2.docx" fait négligé dans l'onglet du lecteur et se classe mal dans une bibliothèque de documents, alors qu'un titre, un auteur et des mots-clés véritables rendent le fichier bien plus facile à retrouver ensuite, sur votre propre machine comme pour quiconque fouille un lecteur partagé. La seconde raison est la confidentialité. Les métadonnées se recopient de façon invisible : un PDF exporté depuis un modèle peut encore nommer l'auteur d'origine, un nom de code interne de projet, ou la copie sous licence du logiciel utilisé. Avant de publier un document, d'envoyer un CV ou de déposer une pièce publiquement, il vaut la peine de vérifier ce que le fichier raconte à votre place. "Vider tous les champs" efface chaque entrée d'un clic.
L'utilisation se résume à trois étapes. Déposez un PDF ou choisissez-le sur votre appareil, et les valeurs actuelles apparaissent dans le formulaire, accompagnées du nombre de pages. Modifiez ce que vous voulez, ajoutez des mots-clés séparés par des virgules, ajustez la date de création, et décidez si la date de modification doit être horodatée à l'instant présent ou rester inchangée. Enregistrez ensuite : le PDF modifié se télécharge immédiatement. Seules les métadonnées sont réécrites ; pages, textes, images, liens, champs de formulaire et mise en page passent intacts, car le fichier est reconstruit à partir des objets d'origine et non recomposé.
Tout cela se déroule en local. Le PDF est analysé et réécrit dans votre navigateur avec pdf-lib : le document ne quitte jamais votre appareil, n'est jamais envoyé à un serveur, et rien ne subsiste après la fermeture de l'onglet. C'est important quand le fichier est un contrat, un dossier médical, une facture ou tout autre document que vous préférez ne pas confier à un convertisseur en ligne. Deux limites méritent d'être signalées : les PDF protégés par mot de passe doivent d'abord être déverrouillés, un fichier chiffré ne pouvant pas être analysé, et les métadonnées XMP, un second flux plus moderne qu'écrivent aussi certains outils de publication, sont conservées telles quelles plutôt que réécrites. Pour les propriétés de document que les lecteurs et les gestionnaires de fichiers affichent réellement, ce sont bien les champs proposés ici qui comptent.
Ces métadonnées qui ont trahi leurs auteurs
Les métadonnées de documents ont un long palmarès d'embarras pour leurs propriétaires. En 2003, le gouvernement britannique publiait un dossier sur les programmes d'armement irakiens ; des chercheurs ont examiné le journal de révisions du fichier Word et y ont trouvé les noms des fonctionnaires qui l'avaient édité ainsi que des traces de texte repris d'un article universitaire, une découverte connue depuis comme l'affaire du "dodgy dossier", qui a propulsé les propriétés de document en première page. En 2005, un tribunal italien obtenait un rapport de l'OTAN sur la mort d'un agent de renseignement à Bagdad, publié en PDF avec les passages sensibles noircis ; le caviardage avait été dessiné par-dessus le texte au lieu de le supprimer, si bien que n'importe qui pouvait copier les mots directement depuis le fichier.
Le scénario se répète parce que les métadonnées sont invisibles par construction. Le dictionnaire d'informations d'un PDF est recopié lors des fusions de fichiers, survit à la plupart des conversions et est écrit automatiquement par le logiciel qui a exporté le document. C'est ainsi que l'auteur d'une fuite anonyme a été identifié grâce à un champ Créateur, que le nom de code interne d'un produit non annoncé a filtré dans une ligne Sujet, et qu'un rapport prétendument indépendant a été relié à l'entreprise qui l'avait commandé. Les journalistes d'investigation vérifient ces champs en premier, précisément parce que très peu d'auteurs y pensent.
Le remède fait désormais partie des pratiques professionnelles. Les cabinets d'avocats appliquent un "nettoyage de métadonnées" aux documents sortants, et les organismes de normalisation ont défini des sous-ensembles du PDF pour des usages précis : PDF/A pour l'archivage à long terme, qui exige des métadonnées présentes et autodescriptives afin qu'un fichier reste interprétable des décennies plus tard, et PDF/X pour la production imprimée. Les deux objectifs tirent en sens inverse, l'un voulant des métadonnées riches pour la postérité et l'autre n'en voulant aucune par souci de confidentialité, et c'est pourquoi un bon éditeur permet les deux : remplir les champs correctement quand le document est destiné à être trouvé, et les vider complètement quand il ne l'est pas.