PDF-Glossar: OCR, Flatten, Linearisieren, PDF/A und mehr erklärt
Aktualisiert 13. Juli 2026
PDF-Terminologie wird oft verwendet, ohne viel zu erklären. Hier ist, was die gängigen Begriffe tatsächlich bedeuten, in verständlicher Sprache, mit einem Link zum passenden HivePDF-Tool.
OCR (optische Zeichenerkennung)
Verwandelt das Bild von Text auf einer gescannten Seite in tatsächlichen, markierbaren Text, unsichtbar unter dem Bild eingebettet. Ohne OCR ist ein gescanntes PDF nur ein Foto — Sie können es nicht durchsuchen, nichts daraus kopieren oder von einem Screenreader vorlesen lassen. → PDF OCR
Flatten
Bäckt interaktive Inhalte — Formularfeldwerte, Anmerkungen, Ebenen — direkt in den statischen Seiteninhalt ein und entfernt die interaktiven Elemente selbst. Ein geflachtes Formular kann seine Antworten nicht mehr geändert bekommen; eine geflachte Anmerkung wird Teil der Seite statt eines separaten, bearbeitbaren Objekts. → PDF glätten
Linearisieren (a.k.a. “Fast Web View”)
Organisiert die interne Struktur eines PDFs so um, dass die erste Seite bereits gerendert werden kann, bevor die gesamte Datei heruntergeladen wurde — nützlich für große PDFs, die im Browser angesehen werden, bei denen eine linearisierte Datei Seite 1 fast sofort anzeigt, statt auf den gesamten Download zu warten.
PDF/A
Eine Archivvariante des PDF-Formats, die darauf ausgelegt ist, auch in Jahrzehnten identisch dargestellt zu werden — sie erfordert das Einbetten aller Schriftarten, verbietet externe Verweise und vermeidet Funktionen (wie Verschlüsselung oder JavaScript), die im Laufe der Zeit aufhören könnten zu funktionieren. Wird für rechtliche Unterlagen, behördliche Einreichungen und alles mit Langzeitaufbewahrungspflichten verwendet. Die meisten alltäglichen PDFs brauchen das nicht.
Schwärzen (Redact)
Entfernt sensible Inhalte dauerhaft, statt sie nur mit einer schwarzen Box zu überdecken — der Unterschied ist wichtig, weil ein einfaches schwarzes Rechteck den ursprünglichen Text darunter oft intakt und extrahierbar lässt. Echte Schwärzung entfernt den Inhalt selbst. → PDF schwärzen · siehe auch wie man ein PDF sicher schwärzt
Metadaten
Die versteckten Informationen, die an ein PDF angehängt sind, über den sichtbaren Inhalt hinaus — Autor, Titel, Erstellungsdatum, die Software, mit der es erstellt wurde, manchmal sogar der Bearbeitungsverlauf. Es lohnt sich, das vor dem öffentlichen Teilen eines Dokuments zu prüfen (und manchmal zu entfernen). → PDF-Metadaten bearbeiten
Verschlüsseln / Schützen
Fügt eine Passwortanforderung zum Öffnen eines PDFs hinzu (und schränkt optional das Drucken, Kopieren oder Bearbeiten ein, selbst für jemanden, der das Passwort hat). Anders als Schwärzung — Verschlüsselung steuert, wer die Datei überhaupt öffnen kann, nicht was sichtbar ist, sobald sie geöffnet ist. → PDF schützen
Komprimieren (rasterisieren vs. neu kodieren)
Verkleinerung der Dateigröße, meist durch Reduzierung der Bildqualität oder -auflösung. Rasterisieren wandelt eine Seite in ein einziges Bild um (üblich bei gescannten Seiten); Neukodieren komprimiert lediglich vorhandene Bilder auf einer Seite neu und lässt echten Text unangetastet. Der Unterschied ist wichtig, weil das Rasterisieren einer Textseite deren markierbaren Text zerstört — ein guter Kompressor (wie der von HivePDF) rasterisiert nur Seiten, die von Anfang an bereits Bilder waren. → PDF komprimieren
Ausfüllbares Formularfeld
Ein interaktives Element in einem PDF — ein Textfeld, ein Kontrollkästchen oder ein Dropdown —, das ein Leser direkt anklicken und ausfüllen kann, im Gegensatz zu einem “flachen” PDF, das nur wie ein Formular aussieht, aber nichts zum Anklicken hat. → PDF-Formular ausfüllen
Clientseitige / browserinterne Verarbeitung
Software, die vollständig in Ihrem Webbrowser mittels WebAssembly läuft, statt Ihre Datei auf einen Server hochzuladen. Das entscheidende Merkmal: Sie funktioniert auch ohne Internetverbindung weiter, sobald die Seite einmal geladen wurde, weil kein Server im Spiel ist. → wie clientseitige PDF-Verarbeitung funktioniert