# Converta um PDF em Markdown

Reconstrua o texto de um PDF em Markdown, com títulos, listas e parágrafos prontos para editar. O arquivo é analisado neste aparelho, sem nenhuma etapa de upload.

## Em resumo

O CommonMark, a especificação precisa do Markdown, hoje na versão 0.31.2, guarda a estrutura em texto simples: `#` marca um título e `-` um item de lista. O pd00 lê a camada de texto de um PDF com o pdf.js e gera um arquivo `.md` em que linhas pelo menos 12% maiores que o corpo do texto viram títulos de `#` a `###`, linhas com marcadores ou números viram listas e cada quebra de página vira uma linha `---`.

## Passo a passo: PDF para Markdown

1. **Abra um PDF que tenha texto**  
   Escolha um PDF ou solte-o na ferramenta. Ele precisa de uma camada de texto: se você não consegue selecionar palavras no seu leitor de PDF, o arquivo é uma digitalização e deve passar antes pelo OCR em PDF.
2. **Leia a prévia**  
   Clique em “Converter em Markdown” e o Markdown reconstruído aparece na página. Confira se os títulos e as listas caíram onde você espera, principalmente em documentos com colunas ou tabelas.
3. **Copie ou guarde o .md**  
   Clique em “Copiar texto” para colar o Markdown em um editor, wiki ou chat, ou baixe-o como arquivo .md para guardar junto com suas outras anotações.

## Um exemplo na prática

Um guia de duas páginas, `guia.pdf`, usa 10 pt no corpo do texto, 18 pt no título, 14 pt nos títulos de seção e 12 pt nos subtítulos, com os passos marcados por “•”. O `guia.md` resultante contém:

- `#` para o título de 18 pt, `##` para os títulos de 14 pt e `###` para os subtítulos de 12 pt (12 ÷ 10 = 1,2, acima do limiar de 1,12);
- `-` no lugar de cada “•”;
- uma linha `---` onde começa a página 2.

Uma linha de 11 pt continua sendo corpo do texto (11 ÷ 10 = 1,1). A exceção é uma linha em negrito com menos de 80 caracteres que não seja item de lista e não termine em ponto, dois-pontos, ponto e vírgula ou vírgula: ela também vira um título `###`.

## O que a ferramenta faz e quais são os limites

- Precisa de uma camada de texto: uma digitalização não gera Markdown até que o [OCR em PDF](https://pd00.com/pt/ocr-pdf/) acrescente uma.
- Tabelas viram linhas simples, e não tabelas do GitHub Flavored Markdown, e as imagens ficam de fora; salve-as com o [Extrair imagens do PDF](https://pd00.com/pt/extrair-imagens-pdf/).
- Só três níveis de título: um quarto tamanho de título, ou menor, também sai como `###`.
- Negrito, itálico e links não são marcados, e layouts de duas colunas podem intercalar linhas de colunas vizinhas.

## Fontes

- [CommonMark Spec](https://spec.commonmark.org/), CommonMark
- [GitHub Flavored Markdown Spec](https://github.github.com/gfm/), GitHub
- [PDF.js](https://mozilla.github.io/pdf.js/), Mozilla

Links verificados em 10 de outubro de 2026.

## PDF para Markdown: como funciona

Um PDF registra onde cada trecho de texto fica na página e qual é o tamanho dele, mas raramente diz qual linha é um título ou quais linhas formam uma lista. Este conversor lê a camada de texto com o pdf.js, toma essas decisões por conta própria e escreve o resultado em Markdown:

- **Títulos** são deduzidos de textos em fonte maior que a do corpo.
- **Listas** vêm de linhas que começam com um símbolo de marcador ou um número, e viram itens com marcadores ou numerados.
- **Parágrafos** são reunidos de novo: as linhas que o PDF quebrou na margem direita voltam a correr juntas, então você não ganha uma quebra de linha forçada a cada dúzia de palavras.
- **Quebras de página** são marcadas com uma linha horizontal, `---`.

O Markdown aparece em uma prévia na página. O botão **Copiar texto** leva tudo para a área de transferência, ou você pode salvar como arquivo `.md`. Por ser texto simples, o resultado abre em qualquer editor e vai direto para wikis, apps de notas e sites de documentação que usam Markdown.

### Trate a estrutura como um primeiro rascunho

Cada título e cada lista do resultado é uma dedução a partir de pistas visuais. Um título em negrito no tamanho do corpo pode sair como linha comum, enquanto uma citação em destaque, em letra grande, pode ser promovida a título. Dê uma olhada na prévia antes de confiar nela, principalmente em documentos longos ou com muito design.

## Quando usar

### Levar um manual antigo para uma wiki

Um guia de produto que só sobreviveu em PDF pode virar páginas em Markdown com os títulos de seção e as listas de passos intactos, prontas para dividir em tópicos e editar no seu sistema de documentação.

### Editar um relatório cujo arquivo original sumiu

Quando o arquivo original do processador de texto se perdeu, o Markdown dá a você texto editável com a estrutura no lugar. Faça as alterações e depois gere um PDF novo com o Markdown para PDF.

### Passar um documento longo para um assistente de IA

Assistentes de chat leem Markdown com facilidade, e os marcadores de título mostram a eles em que seção cada parágrafo está. Cole as seções de que precisa em vez de anexar o PDF inteiro.

## Tabelas, imagens e páginas com várias colunas

**Tabelas** não são reconstruídas como tabelas em Markdown. Dentro de um PDF, uma tabela é só um conjunto de palavras posicionadas em coordenadas, sem cadastro de linhas ou células, então o conteúdo das células sai como linhas de texto separadas. Refaça à mão as tabelas importantes ou guarde uma imagem fiel da página com o [PDF para PNG](https://pd00.com/pt/pdf-para-png/).

**Imagens** ficam de fora do Markdown. Para manter fotos, gráficos e figuras, salve-as com o [Extrair imagens do PDF](https://pd00.com/pt/extrair-imagens-pdf/) e coloque você mesmo os links para elas no seu Markdown.

**Layouts com várias colunas**, como boletins informativos e artigos acadêmicos, podem se intercalar, com linhas de colunas vizinhas se alternando. Documentos de uma coluna exportados de um processador de texto ou de uma página da web dão o resultado mais limpo.

## Digitalizações precisam antes de uma camada de texto

Um PDF digitalizado contém imagens das páginas e nenhum caractere, então esta ferramenta não tem o que ler e o Markdown sai vazio. Passe o arquivo pelo [OCR em PDF](https://pd00.com/pt/ocr-pdf/), que reconhece as palavras e acrescenta uma camada de texto invisível, e depois traga o arquivo novo de volta para cá. O OCR tem sua própria taxa de erro, então revise nomes e números no que você receber.

## Markdown, texto simples ou imagens: qual saída escolher

- **Markdown (esta ferramenta)** quando você quer a estrutura do documento: títulos, listas e parágrafos limpos que você pode continuar editando.
- **Texto simples**, com o [PDF para texto](https://pd00.com/pt/pdf-para-texto/), quando você quer as palavras exatamente como estão guardadas, com marcadores de página e sem palpites sobre a estrutura.
- **Imagens**, com o [PDF para PNG](https://pd00.com/pt/pdf-para-png/), quando a aparência exata de cada página importa mais que ter texto editável.

## O que é levado junto, e onde tudo acontece

Os caracteres vêm exatamente como o PDF os guarda, então nada se perde com resolução ou compressão. O que o Markdown não consegue descrever fica para trás: fontes, cores, espaçamentos e a posição exata dos elementos na página. O arquivo `.md` resultante é pequeno, já que só guarda texto e alguns símbolos de formatação. Se o arquivo estiver bloqueado, tire a senha com o [Remover senha do PDF](https://pd00.com/pt/remover-senha-pdf/) (você vai precisar saber qual é) e converta a cópia desbloqueada.

A conversão acontece dentro desta aba do navegador, e nem o PDF nem o Markdown são enviados; você pode [confirmar isso por conta própria](https://pd00.com/pt/privacidade/#verify) em poucos passos.

## Perguntas frequentes

### Como converter um PDF em Markdown?

Adicione o PDF aqui, clique em **Converter em Markdown** e o resultado aparece na prévia. Depois, clique em **Copiar texto** ou salve como arquivo `.md`.

### Por que o Markdown saiu vazio?

Não havia caracteres para ler: o arquivo quase certamente é uma digitalização ou um conjunto de fotos salvas como PDF. Torne-o pesquisável com o [OCR em PDF](https://pd00.com/pt/ocr-pdf/) e depois converta o resultado.

### As tabelas viram tabelas em Markdown?

Não. Os PDFs não guardam tabelas como linhas e células, então o texto de cada célula sai como uma linha comum, que você pode reorganizar em tabela à mão.

### O que acontece com imagens e gráficos?

Eles ficam de fora do Markdown. Use o [Extrair imagens do PDF](https://pd00.com/pt/extrair-imagens-pdf/) para salvar separadamente as imagens embutidas.

### Por que uma linha comum virou título?

Os títulos são deduzidos pelo tamanho da fonte, então qualquer linha impressa visivelmente maior que o corpo do texto, como uma citação em destaque ou um número grande, pode ser marcada como título. Apague os caracteres `#` para que ela volte a ser um parágrafo.

### O que significam as linhas --- entre as seções?

Cada uma marca o ponto em que começava uma nova página no PDF. Mantenha-as como separadores ou apague-as para ter um texto contínuo.

### O PDF é enviado durante a conversão?

Não. O pdf.js lê o arquivo no seu navegador e o Markdown é montado no seu aparelho. Veja [como conferir](https://pd00.com/pt/privacidade/#verify).

Atualizado em 11 de outubro de 2026  
https://pd00.com/pt/pdf-para-markdown/
