HivePDF
한국어
← 가이드

PDF에서 텍스트 추출하는 방법

업데이트 2026년 7월 13일

문단을 인용하거나, 문서 내용을 검색하거나, PDF의 텍스트를 다른 도구에 입력해야 할 때가 있습니다. 텍스트를 순수 .txt 파일로 추출하면 PDF 뷰어에서 페이지마다 일일이 복사-붙여넣기 하는 것보다 훨씬 빠릅니다.

단계

  1. PDF를 텍스트로를 열고 파일을 놓습니다.
  2. 텍스트 추출을 클릭합니다.
  3. 모든 내용이 담긴 .txt 파일을 다운로드합니다.

결과물

이 도구는 PDF의 텍스트 레이어를 읽어서 읽는 순서대로 재구성하고 줄바꿈을 보존합니다 — 결과물은 페이지마다 빈 줄로 구분된 깔끔한 순수 텍스트입니다. 인용하거나 검색하거나 다른 곳에 붙여넣을 콘텐츠를 추출하기 위한 도구이지, 시각적 레이아웃을 보존하기 위한 것은 아닙니다. 열, 표, 정확한 간격은 .txt 파일 자체가 레이아웃 개념이 없기 때문에 재현되지 않습니다.

스캔 PDF는 먼저 OCR이 필요합니다

스캔 문서 — 사실상 사진이나 이미지를 이어 붙여 만든 PDF — 는 텍스트 레이어가 전혀 없으므로 이 도구가 추출할 것이 없습니다. 결과가 비어 있거나 “텍스트를 찾을 수 없음” 메시지가 나온다면, 먼저 OCR PDF를 통해 텍스트 레이어를 인식하고 추가한 다음 추출하세요.

참고

모든 처리가 로컬에서 이루어지므로 기밀 문서의 내용은 추출 과정에서 절대 기기 밖으로 나가지 않습니다. 텍스트가 아니라 PDF 안의 이미지가 필요하다면 이미지 추출을 대신 사용하세요.

이 가이드의 도구

자주 묻는 질문

PDF에서 텍스트를 찾을 수 없다고 나오는데, 왜 그런가요?
해당 PDF는 아마도 스캔본 — 즉 실제 텍스트 레이어 없이 페이지 이미지만 모아 놓은 파일일 가능성이 높습니다. 먼저 OCR PDF로 인식 가능한 텍스트 레이어를 추가한 다음 다시 돌아와서 추출하세요.
추출된 텍스트에 열이나 표 같은 원본 레이아웃이 그대로 유지되나요?
아니요. 이 도구는 읽는 순서와 줄바꿈은 보존하여 깔끔한 순수 텍스트를 만들어 내지만, 열이나 표, 정확한 간격을 재현하려고 하지는 않습니다. 그런 것이 필요하다면 순수 텍스트가 아니라 문서 형식이 필요합니다.
텍스트를 추출하면 내 문서가 업로드되나요?
아니요. 텍스트는 전적으로 브라우저 안에서 읽히며, 크거나 민감한 문서라도 절대 기기 밖으로 나가지 않습니다.