Glosario de PDF: OCR, aplanar, linealizar, PDF/A y más explicado
Actualizado 13 de julio de 2026
La terminología de PDF se usa mucho sin demasiada explicación. Aquí tienes lo que realmente significan los términos comunes, en lenguaje sencillo, con un enlace a la herramienta de HivePDF que hace cada uno.
OCR (reconocimiento óptico de caracteres)
Convierte la imagen del texto en una página escaneada en texto real y seleccionable, colocado de forma invisible debajo de la imagen. Sin esto, un PDF escaneado es solo una foto —no puedes buscar en él, copiar de él, ni hacer que un lector de pantalla lo lea en voz alta. → OCR PDF
Aplanar
Graba contenido interactivo —valores de campos de formulario, anotaciones, capas— directamente en el contenido estático de la página, y elimina los elementos interactivos en sí. Un formulario aplanado no puede tener sus respuestas modificadas; una anotación aplanada pasa a ser parte de la página en lugar de un objeto editable aparte. → Aplanar PDF
Linealizar (también llamado “Fast Web View”)
Reorganiza la estructura interna de un PDF para que la primera página pueda empezar a renderizarse antes de que se haya descargado el archivo completo —útil para PDF grandes vistos en un navegador, donde un archivo linealizado muestra la página 1 casi de inmediato en vez de esperar toda la descarga.
PDF/A
Un subconjunto de archivo del formato PDF diseñado para renderizarse de forma idéntica dentro de décadas —requiere incrustar todas las fuentes, prohíbe referencias externas y evita funciones (como el cifrado o JavaScript) que podrían dejar de funcionar con el tiempo. Se usa para registros legales, trámites gubernamentales y cualquier cosa con requisitos de conservación a largo plazo. La mayoría de PDF cotidianos no lo necesitan.
Redactar
Elimina de forma permanente contenido sensible en lugar de solo cubrirlo con una caja negra —la diferencia importa porque un simple rectángulo negro a menudo deja el texto original intacto y extraíble debajo. Una redacción real elimina el contenido en sí. → Redactar PDF · ver también cómo redactar un PDF de forma segura
Metadatos
La información oculta adjunta a un PDF más allá de su contenido visible —autor, título, fecha de creación, el software que lo creó, a veces incluso el historial de edición. Vale la pena revisarla (y a veces eliminarla) antes de compartir un documento públicamente. → Editar metadatos PDF
Cifrar / Proteger
Añade un requisito de contraseña para abrir un PDF (y opcionalmente restringe la impresión, la copia o la edición incluso para alguien que tenga la contraseña). Es distinto de la redacción —el cifrado controla quién puede abrir el archivo en absoluto, no qué es visible una vez abierto. → Proteger PDF
Comprimir (rasterizar frente a recodificar)
Reducir el tamaño del archivo, normalmente disminuyendo la calidad o resolución de las imágenes. Rasterizar convierte una página en una sola imagen (habitual en páginas escaneadas); recodificar solo vuelve a comprimir las imágenes ya existentes en una página, dejando el texto real intacto. La distinción importa porque rasterizar una página de texto destruye su texto seleccionable —un buen compresor (como el de HivePDF) solo rasteriza páginas que ya eran imágenes desde el principio. → Comprimir PDF
Campo de formulario rellenable
Un elemento interactivo en un PDF —un cuadro de texto, una casilla de verificación o un desplegable— que un lector puede hacer clic y escribir directamente, a diferencia de un PDF “plano” que solo parece un formulario pero no tiene nada clicable. → Rellenar formulario PDF
Procesamiento del lado del cliente / en el navegador
Software que funciona por completo dentro de tu navegador web usando WebAssembly, en lugar de subir tu archivo a un servidor. El rasgo definitorio: sigue funcionando sin conexión a internet una vez que la página se ha cargado, porque no hay ningún servidor en el circuito. → cómo funciona el procesamiento de PDF del lado del cliente