Los archivos nunca salen de tu dispositivo.Cómo funciona
Cómo aplicar OCR a un PDF
- 1Arrastra tu PDF escaneado arriba (o haz clic para seleccionarlo).
- 2Haz clic en Hacer buscable — cada página se reconoce por turno (el motor de OCR se descarga una sola vez en el primer uso).
- 3Descarga el PDF buscable.
Preguntas frecuentes
- ¿Se sube mi archivo para el OCR?
- No. El reconocimiento se ejecuta por completo en tu navegador con WebAssembly — tu PDF nunca sale de tu dispositivo. El motor de OCR y los datos del idioma se descargan una sola vez desde una fuente pública (son software, no tu archivo) y luego quedan en caché.
- ¿Qué le hace el OCR a mi PDF?
- Lee el texto de las imágenes de la página y lo vuelve a añadir como una capa invisible situada sobre las palabras. La página sigue viéndose igual, pero ahora puedes buscar, seleccionar y copiar el texto en cualquier lector de PDF.
- ¿Qué idiomas se admiten?
- El inglés funciona mejor ahora mismo. Otros alfabetos, sobre todo los no latinos como el chino, el japonés o el árabe, aún no se admiten.
- ¿Por qué es lento?
- El OCR es un cálculo pesado y se ejecuta localmente en tu dispositivo en lugar de en una granja de servidores. Un documento largo o de alta resolución puede tardar un rato — el precio de mantener tu archivo privado.
Convierte una imagen de texto en texto real
Un PDF escaneado en realidad no es más que imágenes: puedes ver las palabras, pero no puedes buscarlas, seleccionarlas ni copiarlas. El OCR (reconocimiento óptico de caracteres) lee esas imágenes y añade el texto de vuelta como una capa invisible situada exactamente sobre cada palabra. La página se ve idéntica, pero ahora es buscable en cualquier lector. HivePDF hace esto directamente en tu navegador, así que incluso un escaneo sensible nunca sale de tu dispositivo.
Privado, aunque más lento
La mayoría de las herramientas de OCR suben tu documento a un servidor para hacer el trabajo pesado. HivePDF ejecuta el reconocimiento localmente con WebAssembly en su lugar. El motor de OCR y sus datos del idioma inglés se descargan una sola vez desde una fuente pública —eso es software, no tu archivo— y quedan almacenados en caché para la próxima vez. La contrapartida es la velocidad: un escaneo largo o de alta resolución tarda un rato, porque es tu propio dispositivo el que hace el trabajo.
Bueno saberlo
El texto en inglés funciona mejor por ahora; otros alfabetos todavía no son compatibles. El resultado es una página ráster más una capa de texto, así que sigue siendo una copia fiel de tu escaneo. Para reducir el PDF buscable después, usa Comprimir; para extraer las imágenes de página en su lugar, usa PDF a JPG.
Dónde importa más el OCR
Escaneos antiguos, contratos archivados o una pila de papeleo fotografiada con el móvil son casos habituales: nada de eso es buscable hasta que el OCR añade una capa de texto. Esto también importa para la accesibilidad, ya que los lectores de pantalla necesitan texto real, no una imagen de texto, para leer una página en voz alta. Una vez procesado, el archivo se comporta como cualquier otro PDF buscable: puedes buscar una cláusula, copiar un párrafo o indexarlo en un archivo de documentos.