HivePDF
Türkçe
← Tüm araçlar

Taranmış bir PDF'i aranabilir yapın (OCR)

Metnini arayabilmek, seçebilmek ve kopyalayabilmek için taranmış bir PDF'de OCR çalıştırın. HivePDF sayfaların üzerine görünmez bir metin katmanı ekler — hepsi tarayıcınızda, dosyanız asla yüklenmeden.

Bir PDF'yi buraya sürükleyin veya seçmek için tıklayın

Dosyalarınız cihazınızdan hiç ayrılmaz.Nasıl çalışır

Bir PDF nasıl OCR'den geçirilir

  1. 1Taranmış PDF'nizi yukarı bırakın (veya tıklayıp seçin).
  2. 2Aranabilir yap'a tıklayın — her sayfa sırayla tanınır (OCR motoru ilk kullanımda bir kez indirilir).
  3. 3Aranabilir PDF'yi indirin.

Sıkça sorulan sorular

OCR için dosyam yükleniyor mu?
Hayır. Tanıma tamamen tarayıcınızda WebAssembly kullanılarak çalışır — PDF'niz cihazınızdan hiç ayrılmaz. OCR motoru ve dil verileri herkese açık bir kaynaktan bir kez indirilir (bunlar yazılımdır, dosyanız değil) ve ardından önbelleğe alınır.
OCR, PDF'ime ne yapar?
Sayfa görsellerindeki metni okur ve kelimelerin üzerine konumlandırılmış görünmez bir katman olarak geri ekler. Sayfa hâlâ aynı görünür, ancak artık herhangi bir PDF okuyucuda metni arayabilir, seçebilir ve kopyalayabilirsiniz.
Hangi diller destekleniyor?
Şu anda İngilizce en iyi şekilde çalışır. Diğer yazı sistemleri, özellikle Çince, Japonca veya Arapça gibi Latin olmayanlar henüz desteklenmiyor.
Neden yavaş?
OCR ağır bir hesaplamadır ve bir sunucu çiftliğinde değil, doğrudan cihazınızda yerel olarak çalışır. Uzun veya yüksek çözünürlüklü bir belge biraz zaman alabilir — dosyanızı gizli tutmanın karşılığıdır.

Metnin görüntüsünü gerçek metne dönüştürün

Taranmış bir PDF aslında yalnızca görsellerden ibarettir — kelimeleri görebilirsiniz ama arayamaz, seçemez veya kopyalayamazsınız. OCR (optik karakter tanıma), bu görselleri okur ve her kelimenin tam üzerine oturan görünmez bir metin katmanı olarak geri ekler. Sayfa aynı görünür, ama artık herhangi bir okuyucuda aranabilir. HivePDF bunu doğrudan tarayıcınızda yapar, bu yüzden hassas bir tarama bile cihazınızdan asla ayrılmaz.

Özel, ama biraz daha yavaş

Çoğu OCR aracı ağır işi yapmak için belgenizi bir sunucuya yükler. HivePDF bunun yerine tanımayı WebAssembly ile yerel olarak gerçekleştirir. OCR motoru ve İngilizce dil verisi genel bir kaynaktan bir kez indirilir — bu, dosyanız değil, yazılımdır — ve bir sonraki kullanım için önbelleğe alınır. Bunun bedeli hızdır: uzun ya da yüksek çözünürlüklü bir tarama biraz zaman alır, çünkü işi yapan kendi cihazınızdır.

Bilmekte fayda var

Bugün için en iyi sonucu İngilizce metin verir; diğer alfabeler henüz desteklenmiyor. Sonuç, bir raster sayfa artı bir metin katmanıdır, bu yüzden taramanızın sadık bir kopyası olarak kalır. Aranabilir PDF'i sonradan küçültmek için Sıkıştır'ı, sayfa görsellerini ayrı ayrı almak için ise PDF'ten JPG'ye'yi kullanın.

OCR'ın en çok işe yaradığı yerler

Eski taramalar, arşivlenmiş sözleşmeler ya da telefonla fotoğraflanmış bir kağıt yığını yaygın adaylardır — OCR bir metin katmanı eklemeden hiçbiri aranabilir değildir. Bu, erişilebilirlik açısından da önemlidir, çünkü ekran okuyucuların bir sayfayı sesli okuyabilmesi için metnin görüntüsü değil gerçek metin gerekir. İşlendikten sonra dosya diğer aranabilir PDF'ler gibi davranır: bir maddeyi arayabilir, bir paragrafı kopyalayabilir ya da bir belge arşivinde dizinleyebilirsiniz.

İlgili araçlar