Le PDF est devenu un format banal : factures, contrats, formulaires, cours, rapports, justificatifs et documents administratifs circulent quotidiennement sous cette forme. Pourtant, dès qu’il faut le transformer, une question revient : à quel niveau du document faut-il réellement agir ?
Fusionner deux fichiers, retirer trois pages, récupérer une photographie intégrée, ajouter une annotation, OCRiser un scan, assainir un document avant partage ou réduire son poids sont des opérations différentes. Comprendre cette structure permet de choisir immédiatement le bon outil et d’éviter des conversions inutiles.
Cette page sert de point d’entrée à la collection Maîtriser les fichiers PDF.
Un PDF n’est pas simplement une image
Un fichier PDF est organisé en pages. Une page peut contenir du texte, des images raster, des formes vectorielles, des polices, des liens, des annotations et d’autres objets. Deux documents visuellement identiques peuvent donc être construits très différemment.
Un rapport exporté depuis un traitement de texte contient généralement du texte sélectionnable. Un document numérisé peut n’être constitué que d’une grande image par page. Dans les deux cas, le lecteur affiche une page, mais les possibilités de recherche, d’extraction et de transformation diffèrent.
PDF natif, PDF scanné et OCR
Sur un PDF scanné, rechercher un nom ou copier une phrase devient impossible tant qu’une reconnaissance optique de caractères n’a pas ajouté de texte exploitable.
L’OCR PDF interprète les caractères visibles. Sa précision dépend de la résolution, du contraste, de l’orientation, de la langue et de la qualité du document ; un contrôle reste nécessaire lorsque les données reconnues sont importantes.
Pour un document scanné qui doit d’abord être nettoyé, le guide Nettoyer puis OCRiser un PDF scanné présente un Pipeline prêt à l’emploi.
Modifier visuellement un PDF
Lorsque le besoin consiste à voir le document et effectuer plusieurs retouches sur ses pages, commencez par l’Éditeur PDF. Il permet notamment d’ajouter et positionner du texte, de surligner, d’ajouter des formes, une image, un dessin ou une signature visuelle, un filigrane, un en-tête ou un pied de page, et de corriger une rotation dans une même session.
L’éditeur ajoute des éléments au document ; il ne réécrit pas le texte natif déjà présent dans le PDF comme un traitement de texte. Le tutoriel Comment modifier un PDF en ligne : texte, image, signature et annotations détaille les possibilités, les limites et le choix entre éditeur général, outils spécialisés et Workspace.
Pour une seule opération précise, un outil spécialisé reste souvent plus direct : Ajouter une image, Ajouter une signature, ajouter un filigrane ou numéroter les pages, par exemple.
Agir sur les fichiers et les pages
Pour réunir plusieurs documents, utilisez Fusionner des PDF. Pour créer plusieurs parties, Découper un PDF est plus adapté.
Si vous ne souhaitez conserver que certaines pages, utilisez Extraire des pages PDF. Si presque tout le document doit rester sauf quelques pages, Supprimer des pages PDF est plus direct.
Lorsque toutes les pages restent mais pas dans le bon ordre, utilisez Réorganiser les pages PDF. Pour corriger leur orientation, Pivoter des pages PDF suffit.
Le guide Extraire, supprimer, réorganiser ou faire pivoter les pages d’un PDF détaille ces distinctions.
Rendu des pages ou images intégrées ?
PDF vers images rasterise chaque page complète. Extraire les images d’un PDF cherche au contraire les images raster intégrées dans le document sans convertir la page entière.
La nuance est importante. Pour publier le rendu d’une page, utilisez la conversion de pages ; pour récupérer une photographie ou une illustration incorporée, utilisez l’extraction d’images.
Le guide PDF et images développe cette différence et présente aussi le Pipeline de préparation de pages PDF pour le Web.