HivePDF
한국어
← 가이드

PDF를 마크다운으로 변환하는 방법

업데이트 2026년 7월 13일

마크다운은 문서를 LLM, 정적 사이트 생성기, 메모 앱에 입력할 때 선호되는 형식이지만, PDF에는 곧바로 내보낼 수 있는 구조 정보가 없습니다. PDF를 마크다운으로 변환하면 이 간극을 메울 수 있습니다.

단계

  1. PDF를 마크다운으로를 열고 위쪽에 PDF를 끌어다 놓거나 클릭해서 선택하세요.
  2. 마크다운으로 변환을 클릭하세요.
  3. .md 파일을 다운로드하세요.

구조가 추론되는 방식

PDF에는 ’제목’이나 ‘목록 항목’ 같은 개념이 없습니다 — 그저 텍스트가 페이지의 어디에 위치하는지만 알 뿐입니다. HivePDF는 그 레이아웃을 바탕으로 작업합니다. 본문 텍스트보다 눈에 띄게 큰 텍스트는 제목이 되고, 글머리 기호나 번호로 시작하는 줄은 목록 항목이 되며, 나머지는 모두 문단으로 묶입니다. 결과물은 제목 레벨과 목록 구조를 유지하므로, 문서를 RAG 파이프라인용으로 청크로 나누거나 모델이 깔끔하게 파싱할 수 있는 형태가 필요할 때 중요합니다.

한계

구조는 실제 메타데이터를 읽는 것이 아니라 휴리스틱으로 추론되므로, 복잡한 다단 레이아웃이나 표는 마크다운으로 완벽하게 옮겨지지 않을 수 있습니다 — 중요한 용도로 사용하기 전에 결과물을 검토해 볼 가치가 있습니다. 읽을 텍스트 레이어가 없기 때문에 스캔한 문서는 아예 작동하지 않습니다. 먼저 PDF OCR을 거쳐 텍스트 레이어를 추가하세요.

참고 사항

모든 작업이 로컬에서 이루어지므로 업로드되는 것은 없습니다 — 변환 중에도 문서는 기기 밖으로 나가지 않습니다. 마크다운 서식 없이 순수한 텍스트만 필요하다면 PDF를 텍스트로가 더 직접적인 선택지입니다.

이 가이드의 도구

자주 묻는 질문

제목과 목록은 어떻게 감지되나요?
PDF에는 구조 정보가 저장되어 있지 않으므로, HivePDF는 레이아웃에서 이를 추론합니다. 본문보다 눈에 띄게 큰 텍스트는 제목이 되고, 글머리 기호나 번호로 시작하는 줄은 목록 항목이 됩니다. 나머지는 문단으로 묶입니다.
스캔한 PDF에서도 작동하나요?
아니요 — 스캔본은 읽을 수 있는 텍스트 레이어가 없는 이미지일 뿐입니다. 먼저 OCR을 실행해 텍스트 레이어를 추가한 다음 마크다운으로 변환하세요.
파일이 업로드되나요?
아니요. 텍스트는 전적으로 브라우저 내에서 추출되고 변환되며, 문서는 기기 밖으로 나가지 않습니다.