Glossaire PDF : OCR, aplatir, linéariser, PDF/A, et plus expliqués
Mis à jour 13 juillet 2026
La terminologie PDF circule beaucoup sans grande explication. Voici ce que signifient réellement les termes courants, en langage clair, avec un lien vers l’outil HivePDF qui fait chacune de ces opérations.
OCR (reconnaissance optique de caractères)
Transforme l’image du texte d’une page scannée en véritable texte sélectionnable, superposé de façon invisible sous l’image. Sans cela, un PDF scanné n’est qu’une photo — impossible de le rechercher, d’en copier le contenu, ou de le faire lire à voix haute par un lecteur d’écran. → OCR PDF
Aplatir
Intègre le contenu interactif — valeurs des champs de formulaire, annotations, calques — directement dans le contenu statique de la page, et retire les éléments interactifs eux-mêmes. Un formulaire aplati ne peut plus voir ses réponses modifiées ; une annotation aplatie devient partie intégrante de la page plutôt qu’un objet éditable séparé. → Aplatir un PDF
Linéariser (alias « Fast Web View »)
Réorganise la structure interne d’un PDF pour que la première page commence à s’afficher avant que le fichier entier ne soit téléchargé — utile pour les gros PDF consultés dans un navigateur, où un fichier linéarisé affiche la page 1 presque instantanément au lieu d’attendre le téléchargement complet.
PDF/A
Un sous-ensemble d’archivage du format PDF conçu pour s’afficher à l’identique dans des décennies — il exige l’intégration de toutes les polices, interdit les références externes et évite les fonctionnalités (comme le chiffrement ou le JavaScript) susceptibles de cesser de fonctionner avec le temps. Utilisé pour les dossiers juridiques, les dépôts administratifs et tout ce qui nécessite une conservation à long terme. La plupart des PDF du quotidien n’en ont pas besoin.
Caviarder
Retire définitivement le contenu sensible plutôt que de simplement le recouvrir d’un rectangle noir — la différence compte, car un simple rectangle noir laisse souvent le texte d’origine intact et extractible en dessous. Un vrai caviardage retire le contenu lui-même. → Caviarder un PDF · voir aussi comment caviarder un PDF en toute sécurité
Métadonnées
Les informations cachées attachées à un PDF au-delà de son contenu visible — auteur, titre, date de création, le logiciel qui l’a produit, parfois même l’historique des modifications. À vérifier (et parfois à supprimer) avant de partager un document publiquement. → Modifier les métadonnées PDF
Chiffrer / Protéger
Ajoute une exigence de mot de passe pour ouvrir un PDF (et restreint éventuellement l’impression, la copie ou la modification, même pour quelqu’un qui possède le mot de passe). Différent du caviardage — le chiffrement contrôle qui peut ouvrir le fichier tout court, pas ce qui est visible une fois qu’il est ouvert. → Protéger un PDF
Compresser (rastériser vs réencoder)
Réduire la taille du fichier, généralement en diminuant la qualité ou la résolution des images. La rastérisation convertit une page en une seule image (courant pour les pages scannées) ; le réencodage recompresse simplement les images existantes d’une page en laissant le vrai texte intact. Cette distinction compte, car rastériser une page de texte détruit son texte sélectionnable — un bon compresseur (comme celui de HivePDF) ne rastérise que les pages qui étaient déjà des images au départ. → Compresser un PDF
Champ de formulaire remplissable
Un élément interactif dans un PDF — une zone de texte, une case à cocher ou un menu déroulant — sur lequel un lecteur peut cliquer et saisir directement, par opposition à un PDF « plat » qui ressemble à un formulaire mais n’a rien de cliquable. → Remplir un formulaire PDF
Traitement côté client / dans le navigateur
Un logiciel qui s’exécute entièrement dans votre navigateur web via WebAssembly, plutôt que d’envoyer votre fichier sur un serveur. La caractéristique déterminante : cela continue de fonctionner sans connexion internet une fois la page chargée, puisqu’aucun serveur n’intervient. → comment fonctionne le traitement PDF côté client