HivePDF
한국어
← 전체 도구

스캔한 PDF를 검색 가능하게 만들기 (OCR)

스캔한 PDF에 OCR을 실행해 텍스트를 검색하고, 선택하고, 복사할 수 있게 하세요. HivePDF는 페이지 위에 보이지 않는 텍스트 레이어를 덧입힙니다 — 모든 과정이 브라우저에서 이루어지며, 파일은 절대 업로드되지 않습니다.

여기에 PDF를 끌어다 놓거나 클릭해서 선택하세요

파일은 기기를 벗어나지 않습니다.작동 방식

PDF를 OCR 처리하는 방법

  1. 1위에 스캔한 PDF를 끌어다 놓으세요 (또는 클릭해서 선택).
  2. 2검색 가능하게 만들기를 클릭하세요 — 각 페이지가 차례로 인식됩니다 (OCR 엔진은 처음 사용할 때 한 번 다운로드됩니다).
  3. 3검색 가능한 PDF를 다운로드하세요.

자주 묻는 질문

OCR을 위해 제 파일이 업로드되나요?
아니요. 인식은 WebAssembly를 사용해 전적으로 브라우저에서 실행됩니다 — PDF는 절대 기기를 벗어나지 않습니다. OCR 엔진과 언어 데이터는 공개 소스에서 한 번만 다운로드되어(이는 여러분의 파일이 아니라 소프트웨어입니다) 캐시됩니다.
OCR은 제 PDF에 무엇을 하나요?
페이지 이미지 속 텍스트를 읽어, 단어 위에 정확히 배치된 보이지 않는 레이어로 다시 추가합니다. 페이지 모습은 그대로지만, 이제 어떤 PDF 리더에서도 텍스트를 검색하고, 선택하고, 복사할 수 있습니다.
어떤 언어가 지원되나요?
현재는 영어에서 가장 잘 작동합니다. 특히 중국어, 일본어, 아랍어 같은 비라틴 문자는 아직 지원하지 않습니다.
왜 느린가요?
OCR은 무거운 연산이며, 서버 팜이 아니라 여러분의 기기에서 로컬로 실행됩니다. 길거나 고해상도인 문서는 시간이 걸릴 수 있습니다 — 파일을 비공개로 지키기 위한 절충입니다.

텍스트 사진을 진짜 텍스트로 바꾸기

스캔한 PDF는 사실상 이미지일 뿐입니다. 글자는 보이지만 검색하거나, 선택하거나, 복사할 수 없습니다. OCR(광학 문자 인식)은 그 이미지를 읽어 각 단어 바로 위에 정확히 겹쳐지는 보이지 않는 텍스트 레이어를 추가합니다. 페이지는 그대로 보이지만 이제 어떤 리더에서도 검색이 가능합니다. HivePDF는 이 작업을 브라우저 안에서 바로 수행하므로 민감한 스캔본도 절대 기기를 벗어나지 않습니다.

느리지만 사적인

대부분의 OCR 도구는 무거운 작업을 처리하기 위해 문서를 서버에 업로드합니다. HivePDF는 대신 WebAssembly로 로컬에서 인식을 실행합니다. OCR 엔진과 영어 언어 데이터는 공개 소스에서 한 번만 다운로드되며, 이는 소프트웨어이지 사용자의 파일이 아니고, 다음 사용을 위해 캐시됩니다. 대신 속도가 느려질 수 있습니다. 긴 문서나 고해상도 스캔본은 사용자의 기기가 직접 작업을 처리하기 때문에 시간이 걸립니다.

알아두면 좋은 점

현재는 영어 텍스트가 가장 잘 처리됩니다. 다른 문자는 아직 지원되지 않습니다. 결과물은 래스터 페이지와 텍스트 레이어로 구성되므로 원본 스캔본에 충실한 사본으로 남습니다. 검색 가능한 PDF를 이후 줄이려면 압축 도구를, 대신 페이지 이미지를 꺼내려면 PDF to JPG 도구를 사용하세요.

OCR이 가장 중요한 경우

오래된 스캔본, 보관된 계약서, 휴대폰으로 촬영한 서류 더미는 흔한 대상입니다. OCR이 텍스트 레이어를 추가하기 전까지는 아무것도 검색할 수 없습니다. 이는 접근성에도 중요합니다. 화면 낭독기가 페이지를 소리 내어 읽으려면 텍스트 사진이 아니라 실제 텍스트가 필요하기 때문입니다. 처리가 끝나면 파일은 다른 검색 가능한 PDF와 똑같이 작동합니다. 조항을 검색하거나, 문단을 복사하거나, 문서 보관함에 색인화할 수 있습니다.

관련 도구