Conversores de PDF para Markdown
Todos os conversores usam o mesmo motor dentro do navegador, com orientações escritas para uma origem ou um destino diferente. Escolha o que corresponde ao seu arquivo: em nenhum deles o arquivo é enviado. A exceção é o conversor de PDFs digitalizados, que reconhece o texto no nosso servidor e pergunta antes.
A partir de PDF
- PDF para MarkdownTítulos, listas e tabelas reconstruídos a partir do layout da página, no navegador e sem upload.
- PDF para ObsidianTransforme um PDF em nota do cofre com títulos reais: sumário, grafo e links passam a funcionar.
- PDF para NotionLeve o conteúdo do PDF para o Notion como blocos editáveis, não como um anexo de visualização.
- PDF para ChatGPTTransforme PDFs em Markdown estruturado otimizado para prompts do ChatGPT sem enviar arquivos.
- PDF para ClaudeExtraia Markdown estruturado de PDFs para a janela de contexto do Claude sem enviar dados.
- Tabelas de PDF para MarkdownColunas detectadas pelo alinhamento das células e devolvidas como tabelas Markdown (GFM).
- PDF digitalizado (OCR)Reconhece o texto de um PDF digitalizado ou fotografado. Enviado ao nosso servidor com a sua permissão e nunca armazenado.
A partir do Word
Qual deles usar?
Na dúvida, use o conversor de PDF para Markdown. É o caso geral e produz GitHub Flavored Markdown padrão, que funciona em qualquer lugar. As outras páginas existem porque esse mesmo resultado é tratado de formas diferentes conforme o destino.
Use o conversor para Obsidian se o resultado vai para um cofre de notas: ali o que muda não é a conversão, e sim o que você faz depois com títulos, hierarquia de cabeçalhos e links internos.
Use o conversor para Notion se pretende importar ou colar em uma página do Notion, que aceita Markdown mas reconhece um conjunto de blocos mais restrito que o do GitHub.
Use o conversor para ChatGPT ou para Claude se o texto vai direto para um modelo de linguagem. As duas páginas tratam do mesmo: não desperdiçar tokens com elementos de página repetidos e fazer tabelas e níveis de título chegarem sem quebrar.
Use o conversor de tabelas quando as tabelas forem o próprio motivo da conversão: células mescladas, texto que quebra em várias linhas e colunas desalinhadas têm soluções próprias.
Use o conversor de Word se o seu arquivo for um .docx e não um PDF. É a única página daqui cuja origem não é um PDF, e a conversão sai mais fiel: o Word guarda os próprios cabeçalhos, níveis de lista e células, então nada precisa ser deduzido do desenho da página.
Use o conversor de PDFs digitalizados apenas se o conversor comum não devolveu nada. Essa é justamente a assinatura de uma digitalização: um documento sem texto selecionável para ler.
O que todos têm em comum
Existe um único motor de conversão por trás de cada página. Ele lê o PDF com PDF.js dentro de um Web Worker no seu navegador, mede a geometria do texto e deduz a estrutura: corpos de fonte maiores que o texto comum viram cabeçalhos, linhas próximas viram parágrafos, e linhas alinhadas em colunas compartilhadas viram tabelas.
O caminho do Word é o mesmo motor por outra porta. O .docx é descompactado no seu navegador e lido diretamente — os nomes de estilo dão os cabeçalhos e as definições de numeração dão as listas — e dali segue para o mesmo renderizador de Markdown, de modo que um mesmo documento salvo das duas formas converte igual.
Todos são gratuitos, dispensam conta e aceitam arquivos de até 50 MB. Negrito, itálico, código embutido e links incorporados são preservados. Imagens não são extraídas e fórmulas matemáticas não são convertidas para LaTeX.
O que envia o arquivo, e por que fica à parte
Uma página digitalizada é uma fotografia: não contém texto algum, então nada executado no seu navegador consegue lê-la, por melhor que seja o analisador. É preciso reconhecimento óptico de caracteres, que exige muito mais processamento do que uma aba tem.
Por isso PDFs digitalizados ganham um conversor próprio em vez de virarem uma caixa de seleção nos demais. Manter isso separado é o que permite a todas as outras páginas afirmarem, sem ressalvas, que seu arquivo nunca sai do seu dispositivo.
Quando você o usa, ele pergunta antes: uma caixa de diálogo informa quantas páginas serão enviadas, para onde vão e por quanto tempo ficam, e nada é transmitido até você confirmar.