PDF를 Markdown으로 변환: 레이아웃 복원
PDF는 문자 위치 좌표만 저장할 뿐 제목이나 표 구조를 직접 저장하지 않습니다. 본 도구는 시각적 배치 좌표를 분석하여 깔끔한 Markdown 구조를 재구성합니다.
23 개의 평가 기준 5점 만점에 5.0점
여기에 PDF 또는 Word 파일을 놓으세요
또는 컴퓨터에서 파일을 선택하세요
PDF 또는 Word (.docx) · 최대 50 MB
PDF에서 제목과 표를 어떻게 복원하나요?
브라우저 안에서 각 줄의 글꼴 크기와 기준선 좌표를 측정합니다. 본문보다 뚜렷하게 큰 줄은 H1부터 H4까지의 제목이 되고, 같은 열 위치에 정렬된 텍스트는 GFM 파이프 표로 묶입니다. 파일은 기기를 벗어나지 않습니다.
변환 중 파일이 서버로 전송되나요?
아니요. 변환은 브라우저의 Web Worker 안에서 끝나며, 파일 바이트도 추출된 텍스트도 서버로 전송되거나 모델 학습에 사용되지 않습니다. 가입은 필요 없고 파일당 50MB까지 지원합니다.
PDF를 Markdown으로 변환하는 방법
- 1
PDF 선택
PDF 파일을 드롭존으로 끌어다 놓거나 컴퓨터에서 선택합니다.
- 2
구조 자동 분석
브라우저 내 PDF.js가 레이아웃과 텍스트 구조를 분석합니다.
- 3
Markdown 복사 및 저장
생성된 Markdown 텍스트를 복사하거나 .md 파일로 내려받습니다.
복원 가능한 구조 요소
폰트 크기와 좌표 정렬을 분석하여 최적의 Markdown 문법으로 변환합니다.
- H1부터 H4까지의 단계별 제목 구조
- 글머리 기호 및 번호 매기기 목록
- GFM(GitHub Flavored Markdown) 파이프 표
- 2단 편집 논문의 올바른 읽기 순서
복원되지 않는 것
PDF 안의 그림은 추출되지 않고 주변 텍스트만 남습니다. 수식은 LaTeX로 변환되지 않고 페이지에 있는 문자 그대로 출력됩니다. 암호가 걸린 PDF도 변환할 수 있으며, 암호는 기기 안에만 머무릅니다.
자주 묻는 질문
- 스캔된 PDF 이미지도 변환되나요?
- 브라우저에서는 변환되지 않습니다. 스캔본은 글자를 찍은 이미지라 페이지에 읽을 수 있는 텍스트 층이 없습니다. 서버에서 문자 인식을 수행하는 별도의 스캔 PDF 변환기가 있으며, 전송 전에 매번 확인을 요청합니다.