# PDF를 마크다운으로 변환

PDF의 텍스트를 바로 편집할 수 있는 제목, 목록, 문단을 갖춘 마크다운으로 다시 구성합니다. 파일은 이 기기에서 해석되며 업로드 단계가 없습니다.

## 핵심 요약

마크다운을 엄밀하게 정의한 사양인 CommonMark(현재 0.31.2판)는 구조를 일반 텍스트로 표시합니다. `#`은 제목을, `-`는 목록 항목을 나타냅니다. pd00은 pdf.js로 PDF의 텍스트 레이어를 읽어 `.md` 파일을 만드는데, 본문보다 12% 이상 큰 줄은 `#`~`###` 제목으로, 글머리 기호나 번호가 붙은 줄은 목록으로, 페이지 구분은 `---` 구분선으로 바뀝니다.

## PDF 마크다운 변환 사용 방법

1. **텍스트가 있는 PDF 불러오기**  
   PDF를 고르거나 도구 위에 끌어다 놓으세요. 텍스트 레이어가 있어야 합니다. PDF 뷰어에서 단어를 드래그해 선택할 수 없다면 스캔본이므로 먼저 PDF OCR을 거치세요.
2. **미리 보기 살펴보기**  
   다시 구성한 마크다운이 페이지에 나타납니다. 특히 여러 단이나 표가 있는 문서라면 제목과 목록이 예상한 자리에 들어갔는지 확인하세요.
3. **복사하거나 .md로 보관하기**  
   ‘텍스트 복사’를 눌러 마크다운을 편집기, 위키, 채팅에 붙여 넣거나, .md 파일로 다운로드해 다른 메모와 함께 보관하세요.

## 예시로 살펴보기

2페이지짜리 안내서 `안내서.pdf`는 본문이 10 pt, 문서 제목이 18 pt, 섹션 제목이 14 pt, 소제목이 12 pt이고, 단계마다 “•” 기호가 붙어 있습니다. 결과 파일 `안내서.md`에는 다음이 들어갑니다.

- 18 pt 문서 제목에는 `#`, 14 pt 섹션 제목에는 `##`, 12 pt 소제목에는 `###`(12 ÷ 10 = 1.2로 기준값 1.12보다 큼)
- 모든 “•” 자리에 `-`
- 2페이지가 시작되는 곳에 `---` 줄

11 pt 줄은 본문으로 남습니다(11 ÷ 10 = 1.1). 예외가 하나 있는데, 80자 미만의 굵은 줄이 목록 항목이 아니고 마침표, 콜론, 세미콜론, 쉼표로 끝나지 않으면 이 줄도 `###` 제목이 됩니다.

## 할 수 있는 일과 한계

- 텍스트 레이어가 필요합니다. 스캔본은 [PDF OCR](https://pd00.com/ko/ocr-pdf/)로 텍스트 레이어를 더하기 전에는 마크다운이 나오지 않습니다.
- 표는 GitHub Flavored Markdown 표가 아니라 일반 줄이 되고, 이미지는 빠집니다. 이미지는 [PDF 이미지 추출](https://pd00.com/ko/extract-images-from-pdf/)로 저장하세요.
- 제목은 세 단계까지만 구분합니다. 네 번째 이하 크기의 제목도 `###`으로 기록됩니다.
- 굵은 글씨, 기울임꼴, 링크는 마크다운으로 표시되지 않으며, 2단 레이아웃에서는 이웃한 단의 줄이 뒤섞일 수 있습니다.

## 출처

- [CommonMark Spec](https://spec.commonmark.org/), CommonMark
- [GitHub Flavored Markdown Spec](https://github.github.com/gfm/), GitHub
- [PDF.js](https://mozilla.github.io/pdf.js/), Mozilla

2026년 10월 10일에 링크를 확인했습니다.

## PDF 마크다운 변환 소개

PDF는 텍스트 조각이 페이지의 어디에 있고 얼마나 큰지는 기록하지만, 어느 줄이 제목이고 어느 줄이 목록에 속하는지는 거의 알려 주지 않습니다. 이 변환기는 pdf.js로 텍스트 레이어를 읽어 그 판단을 스스로 내린 뒤, 결과를 마크다운으로 씁니다.

- **제목**은 본문보다 큰 글꼴로 된 텍스트에서 추정합니다.
- **목록**은 글머리 기호나 숫자로 시작하는 줄에서 만들어지며, 글머리 기호 목록이나 번호 목록의 항목이 됩니다.
- **문단**은 다시 이어 붙입니다. PDF가 오른쪽 여백에서 끊은 줄을 다시 하나로 이어 주므로, 열몇 단어마다 강제 줄바꿈이 생기지 않습니다.
- **페이지 구분**은 가로 구분선(`---`)으로 표시합니다.

마크다운은 페이지의 미리 보기에 나타납니다. **텍스트 복사** 버튼으로 전체를 클립보드에 넣거나 `.md` 파일로 저장할 수 있습니다. 결과물은 일반 텍스트이므로 어떤 편집기에서든 열리고, 마크다운을 쓰는 위키, 메모 앱, 문서 사이트에 그대로 넣을 수 있습니다.

### 구조는 초안으로 여기세요

결과물의 제목과 목록은 모두 시각적 단서로 추정한 것입니다. 본문과 같은 크기의 굵은 글씨로 된 제목은 평범한 줄로 나올 수 있고, 크게 키운 인용구는 제목으로 올라갈 수 있습니다. 특히 길거나 디자인이 많이 들어간 문서라면, 결과를 믿고 쓰기 전에 미리 보기를 훑어보세요.

## 이럴 때 사용합니다

### 오래된 설명서를 위키로 옮기기

PDF로만 남아 있는 제품 안내서를 섹션 제목과 단계 목록이 살아 있는 마크다운 페이지로 바꿀 수 있습니다. 주제별로 나누어 문서 시스템에서 바로 편집하면 됩니다.

### 원본 파일이 없어진 보고서 고치기

워드프로세서 원본 파일을 잃어버렸다면, 마크다운으로 바꿔 개요가 그대로 살아 있는 편집 가능한 텍스트를 얻을 수 있습니다. 내용을 고친 다음 마크다운 PDF 변환으로 새 PDF를 만드세요.

### 긴 문서를 AI 어시스턴트에 넣기

채팅 어시스턴트는 마크다운을 쉽게 읽고, 제목 표시를 보고 문단이 어느 섹션에 속하는지 파악합니다. PDF 전체를 첨부하지 말고 필요한 섹션만 붙여 넣으세요.

## 표, 이미지, 여러 단으로 된 페이지

**표**는 마크다운 표로 다시 만들어지지 않습니다. PDF 안의 표는 좌표에 놓인 단어일 뿐 행이나 칸에 대한 기록이 없으므로, 칸의 내용은 각각 별도의 텍스트 줄로 나옵니다. 중요한 표는 직접 다시 만들거나, [PDF PNG 변환](https://pd00.com/ko/pdf-to-png/)으로 페이지 모습을 그대로 담은 그림을 남겨 두세요.

**이미지**는 마크다운에서 빠집니다. 사진, 차트, 그림을 남기려면 [PDF 이미지 추출](https://pd00.com/ko/extract-images-from-pdf/)로 저장한 뒤 마크다운에 직접 링크하세요.

소식지나 학술 논문 같은 **여러 단 레이아웃**은 이웃한 단의 줄이 번갈아 나오며 뒤섞일 수 있습니다. 워드프로세서나 웹페이지에서 내보낸 1단 문서가 가장 깔끔한 결과를 냅니다.

## 스캔본에는 먼저 텍스트 레이어가 필요합니다

스캔한 PDF에는 페이지 이미지만 있고 문자는 없으므로, 이 도구가 읽을 것이 없어 마크다운이 비어서 나옵니다. 단어를 인식해 보이지 않는 텍스트 레이어를 더해 주는 [PDF OCR](https://pd00.com/ko/ocr-pdf/)에 파일을 넣은 뒤, 새로 만든 파일을 여기로 가져오세요. OCR에도 나름의 오류율이 있으므로 결과에서 이름과 숫자는 꼭 교정하세요.

## 마크다운, 일반 텍스트, 이미지 중 알맞은 출력 고르기

- **마크다운(이 도구)**: 제목, 목록, 깔끔한 문단처럼 계속 편집할 수 있는 문서의 개요가 필요할 때.
- **일반 텍스트**([PDF 텍스트 추출](https://pd00.com/ko/pdf-to-text/)): 구조를 추측하지 않고, 페이지 표시와 함께 저장된 그대로의 글자가 필요할 때.
- **이미지**([PDF PNG 변환](https://pd00.com/ko/pdf-to-png/)): 편집할 수 있는 텍스트보다 각 페이지의 정확한 모양이 더 중요할 때.

## 옮겨지는 것과 처리되는 곳

문자는 PDF에 저장된 그대로 옮겨지므로 해상도나 압축 때문에 잃는 것이 없습니다. 마크다운으로 나타낼 수 없는 것, 곧 글꼴, 색, 간격, 페이지 위의 정확한 위치는 옮겨지지 않습니다. 결과 `.md` 파일은 텍스트와 몇 가지 서식 기호만 담기 때문에 용량이 작습니다. 파일이 잠겨 있다면 [PDF 비밀번호 해제](https://pd00.com/ko/unlock-pdf/)로 비밀번호를 없앤 뒤(비밀번호를 알고 있어야 합니다) 잠금이 풀린 사본을 변환하세요.

변환은 이 브라우저 탭 안에서 이루어지며, PDF도 마크다운도 업로드되지 않습니다. 몇 단계만 거치면 [직접 확인](https://pd00.com/ko/privacy/#verify)할 수 있습니다.

## 자주 묻는 질문

### PDF를 마크다운으로 변환하려면 어떻게 하나요?

여기에 PDF를 추가하면 미리 보기에 마크다운이 나타납니다. **텍스트 복사**를 누르거나 `.md` 파일로 저장하세요.

### 마크다운 결과가 비어 있는 이유는 무엇인가요?

읽을 문자가 없었기 때문입니다. 그 파일은 스캔본이거나 사진 여러 장을 PDF로 저장한 것일 가능성이 큽니다. [PDF OCR](https://pd00.com/ko/ocr-pdf/)로 검색 가능하게 만든 뒤 그 결과를 변환하세요.

### 표가 마크다운 표로 변환되나요?

아닙니다. PDF는 표를 행과 칸으로 저장하지 않으므로 각 칸의 텍스트가 평범한 줄로 나옵니다. 이 줄들을 직접 표로 다시 배열하면 됩니다.

### 이미지와 차트는 어떻게 되나요?

마크다운에서는 빠집니다. PDF에 들어 있는 그림은 [PDF 이미지 추출](https://pd00.com/ko/extract-images-from-pdf/)로 따로 저장하세요.

### 평범한 줄이 왜 제목이 되었나요?

제목은 글자 크기로 추정하기 때문에, 강조 인용구나 큰 숫자처럼 본문보다 눈에 띄게 크게 인쇄된 줄은 제목으로 표시될 수 있습니다. `#` 문자를 지우면 다시 문단이 됩니다.

### 섹션 사이의 --- 줄은 무슨 뜻인가요?

PDF에서 새 페이지가 시작된 곳을 하나씩 표시합니다. 구분선으로 남겨 두거나, 이어지는 텍스트를 원한다면 지우세요.

### 변환하는 동안 PDF가 업로드되나요?

아닙니다. pdf.js가 브라우저에서 파일을 읽고, 마크다운은 내 기기에서 만들어집니다. [확인하는 방법](https://pd00.com/ko/privacy/#verify)은 여기 있습니다.

최종 수정일: 2026년 10월 11일  
https://pd00.com/ko/pdf-to-markdown/
