Métadonnées PDF
Lit et supprime le titre, l’auteur et le producteur.
Cet outil fonctionne avec JavaScript. Pour l’utiliser, activez JavaScript dans votre navigateur et rechargez la page.
LES INFORMATIONS DERRIÈRE LE DOCUMENT.
« Métadonnées PDF » lit les informations de document conservées dans un fichier PDF. La section fichier contient le nom, la taille, la version PDF et le nombre de pages. La section informations du document montre le titre, l'auteur, le sujet, les mots-clés, le programme qui a créé le document, le logiciel qui a produit le PDF ainsi que les dates de création et de modification. La section format de page liste les formats du document en millimètres et le nombre de pages de chaque format; distinguer l'A4 (210 × 297 mm) du Letter devient facile.
L’une des lignes les plus utiles est la couche de texte : l’outil regarde les premières pages et vous dit s’il y a du texte sélectionnable dans le document, en montrant les premières lignes s’il y en a. S’il n’y a pas de couche de texte, les pages sont très probablement une image scannée; les outils de texte comme « PDF → Word » et « PDF → Excel » ne donnent aucun résultat avec de tels documents. On s’en sert aussi pour voir, avant de partager un document, si votre nom ou les informations de votre organisme y figurent encore. Sous le rapport, une copie sans métadonnées est aussi prête : les informations du document (titre, auteur, programme, dates) et le XMP sont retirés; les pages, les signets et les champs de formulaire restent tels quels. Pour les documents signés numériquement, aucune copie n’est créée, car la signature serait rompue.
Du début à la fin
- Envoyez votre PDF. Glissez le fichier ou sélectionnez-le. Les documents jusqu'à 1 Go sont lus.
- Lisez le rapport. Les sections fichier, informations du document, format de page et contenu s'affichent ligne par ligne.
- Téléchargez la copie nettoyée. Avec « Télécharger le fichier sans métadonnées », récupérez la copie sans information d’auteur; enregistrez le rapport en JSON si besoin. Les copies sur le serveur sont supprimées quand vous quittez l’outil.
Questions fréquentes
Que veut dire « pas de couche de texte »?
Les pages sont enregistrées comme image et non comme écriture; le document a été scanné ou composé à partir de photos. Dans ces documents le texte ne peut être ni sélectionné ni recherché, et les outils de texte ne fonctionnent pas. Cela demande une reconnaissance de texte (OCR); l'outil « OCR PDF (reconnaissance de texte) » transforme ces pages en PDF interrogeable ou en texte.
Puis-je supprimer l’information d’auteur?
Oui. Quand le rapport s’affiche, cliquez sur « Télécharger le fichier sans métadonnées » : vous obtenez une copie sans titre, auteur, programme, dates ni XMP. La modification (inscrire un nouvel auteur) n’est pas proposée. Les autres outils PDF de RUPO Studio, eux, conservent le titre et l’auteur.
Que montre la version PDF?
Selon quelle norme PDF le document a été écrit, par exemple 1.4 ou 1.7. À l'usage courant c'est généralement sans importance; des versions très anciennes ou très récentes peuvent poser des problèmes de compatibilité dans certains lecteurs.
Mon fichier reste-t-il sur le serveur?
Non. Votre fichier n’arrive sur le serveur que pour être traité et il est supprimé une fois l’opération terminée; le résultat est lui aussi supprimé dès que vous l’avez téléchargé et quitté l’outil. Aucun compte, nom ou adresse courriel n’est nécessaire, et vos fichiers ne sont jamais envoyés à un service tiers. L’utilisation est gratuite : aucun quota horaire ou journalier sur le nombre de traitements, aucune publicité à regarder avant le traitement et aucun filigrane ajouté au résultat.
Autres outils PDF
RUPO Studio