PDF를 Markdown으로 변환: 레이아웃 복원

PDF는 문자 위치 좌표만 저장할 뿐 제목이나 표 구조를 직접 저장하지 않습니다. 본 도구는 시각적 배치 좌표를 분석하여 깔끔한 Markdown 구조를 재구성합니다.

23 개의 평가 기준 5점 만점에 5.0점

여기에 PDF 또는 Word 파일을 놓으세요

또는 컴퓨터에서 파일을 선택하세요

PDF 또는 Word (.docx) · 최대 50 MB

PDF에서 제목과 표를 어떻게 복원하나요?

브라우저 안에서 각 줄의 글꼴 크기와 기준선 좌표를 측정합니다. 본문보다 뚜렷하게 큰 줄은 H1부터 H4까지의 제목이 되고, 같은 열 위치에 정렬된 텍스트는 GFM 파이프 표로 묶입니다. 파일은 기기를 벗어나지 않습니다.

변환 중 파일이 서버로 전송되나요?

아니요. 변환은 브라우저의 Web Worker 안에서 끝나며, 파일 바이트도 추출된 텍스트도 서버로 전송되거나 모델 학습에 사용되지 않습니다. 가입은 필요 없고 파일당 50MB까지 지원합니다.

PDF를 Markdown으로 변환하는 방법

  1. 1

    PDF 선택

    PDF 파일을 드롭존으로 끌어다 놓거나 컴퓨터에서 선택합니다.

  2. 2

    구조 자동 분석

    브라우저 내 PDF.js가 레이아웃과 텍스트 구조를 분석합니다.

  3. 3

    Markdown 복사 및 저장

    생성된 Markdown 텍스트를 복사하거나 .md 파일로 내려받습니다.

복원 가능한 구조 요소

폰트 크기와 좌표 정렬을 분석하여 최적의 Markdown 문법으로 변환합니다.

  • H1부터 H4까지의 단계별 제목 구조
  • 글머리 기호 및 번호 매기기 목록
  • GFM(GitHub Flavored Markdown) 파이프 표
  • 2단 편집 논문의 올바른 읽기 순서

복원되지 않는 것

PDF 안의 그림은 추출되지 않고 주변 텍스트만 남습니다. 수식은 LaTeX로 변환되지 않고 페이지에 있는 문자 그대로 출력됩니다. 암호가 걸린 PDF도 변환할 수 있으며, 암호는 기기 안에만 머무릅니다.

자주 묻는 질문

스캔된 PDF 이미지도 변환되나요?
브라우저에서는 변환되지 않습니다. 스캔본은 글자를 찍은 이미지라 페이지에 읽을 수 있는 텍스트 층이 없습니다. 서버에서 문자 인식을 수행하는 별도의 스캔 PDF 변환기가 있으며, 전송 전에 매번 확인을 요청합니다.

관련 변환기

Further reading