PDF에서 텍스트 추출하는 방법
업데이트 2026년 7월 13일
문단을 인용하거나, 문서 내용을 검색하거나, PDF의 텍스트를 다른 도구에 입력해야 할 때가 있습니다. 텍스트를 순수 .txt 파일로 추출하면 PDF 뷰어에서 페이지마다 일일이 복사-붙여넣기 하는 것보다 훨씬 빠릅니다.
단계
- PDF를 텍스트로를 열고 파일을 놓습니다.
- 텍스트 추출을 클릭합니다.
- 모든 내용이 담긴
.txt파일을 다운로드합니다.
결과물
이 도구는 PDF의 텍스트 레이어를 읽어서 읽는 순서대로 재구성하고 줄바꿈을 보존합니다 — 결과물은 페이지마다 빈 줄로 구분된 깔끔한 순수 텍스트입니다. 인용하거나 검색하거나 다른 곳에 붙여넣을 콘텐츠를 추출하기 위한 도구이지, 시각적 레이아웃을 보존하기 위한 것은 아닙니다. 열, 표, 정확한 간격은 .txt 파일 자체가 레이아웃 개념이 없기 때문에 재현되지 않습니다.
스캔 PDF는 먼저 OCR이 필요합니다
스캔 문서 — 사실상 사진이나 이미지를 이어 붙여 만든 PDF — 는 텍스트 레이어가 전혀 없으므로 이 도구가 추출할 것이 없습니다. 결과가 비어 있거나 “텍스트를 찾을 수 없음” 메시지가 나온다면, 먼저 OCR PDF를 통해 텍스트 레이어를 인식하고 추가한 다음 추출하세요.
참고
모든 처리가 로컬에서 이루어지므로 기밀 문서의 내용은 추출 과정에서 절대 기기 밖으로 나가지 않습니다. 텍스트가 아니라 PDF 안의 이미지가 필요하다면 이미지 추출을 대신 사용하세요.