En bref
CommonMark, la spécification précise du Markdown, aujourd’hui en version 0.31.2, garde la structure dans du texte brut : # marque un titre et - un élément de liste. pd00 lit la couche de texte d’un PDF avec pdf.js et écrit un fichier .md où les lignes au moins 12 % plus grandes que le corps du texte deviennent des titres # à ###, les lignes à puces ou numérotées deviennent des listes, et chaque saut de page devient une ligne ---.
Mode d’emploi : PDF en Markdown
- Chargez un PDF qui contient du texteChoisissez un PDF ou déposez-le sur l’outil. Il lui faut une couche de texte : si vous ne pouvez pas surligner de mots dans votre lecteur PDF, le fichier est un scan et doit d’abord passer par OCR PDF.
- Relisez l’aperçuLe Markdown reconstruit s’affiche sur la page. Vérifiez que les titres et les listes sont là où vous les attendez, en particulier dans les documents avec des colonnes ou des tableaux.
- Copiez-le ou gardez le .mdAppuyez sur « Copier le texte » pour coller le Markdown dans un éditeur, un wiki ou une messagerie, ou téléchargez-le en fichier .md pour le ranger avec vos autres notes.
Un exemple concret
Un guide de deux pages, guide.pdf, compose son corps de texte en 10 pt, le titre en 18 pt, les titres de section en 14 pt et les sous-titres en 12 pt, avec des étapes marquées par « • ». Le fichier guide.md obtenu contient :
#pour le titre en 18 pt,##pour les titres en 14 pt et###pour les sous-titres en 12 pt (12 ÷ 10 = 1,2, au-dessus du seuil de 1,12) ;-à la place de chaque « • » ;- une ligne
---là où commence la page 2.
Une ligne en 11 pt reste du corps de texte (11 ÷ 10 = 1,1). Exception : une ligne en gras de moins de 80 caractères, qui n’est pas un élément de liste et ne se termine ni par un point, ni par deux-points, ni par un point-virgule, ni par une virgule, devient elle aussi un titre ###.
Ce que fait l’outil, et ses limites
- Il faut une couche de texte : un scan ne produit aucun Markdown tant que OCR PDF ne lui en a pas ajouté une.
- Les tableaux deviennent de simples lignes, et non des tableaux GitHub Flavored Markdown, et les images sont ignorées ; enregistrez-les avec Extraire les images.
- Trois niveaux de titre seulement : une quatrième taille de titre, ou plus petite, est elle aussi écrite en
###. - Le gras, l’italique et les liens ne sont pas balisés, et les mises en page à deux colonnes peuvent entremêler les lignes de colonnes voisines.
Sources
- CommonMark Spec CommonMark
- GitHub Flavored Markdown Spec GitHub
- PDF.js Mozilla
Liens vérifiés le 10 octobre 2026.
PDF en Markdown : ce qu’il faut savoir
Un PDF enregistre où se trouve chaque morceau de texte sur la page et quelle est sa taille, mais il indique rarement quelle ligne est un titre ou quelles lignes forment une liste. Ce convertisseur lit la couche de texte avec pdf.js, fait lui-même ces choix, puis écrit le résultat en Markdown :
- Les titres sont déduits du texte composé dans une police plus grande que le corps.
- Les listes viennent des lignes qui commencent par une puce ou un numéro, transformées en éléments à puces ou numérotés.
- Les paragraphes sont recollés : les lignes que le PDF a coupées à la marge droite se rejoignent, pour éviter un retour à la ligne forcé tous les dix ou douze mots.
- Les sauts de page sont marqués par une ligne horizontale,
---.
Le Markdown apparaît dans un aperçu sur la page. Un bouton Copier le texte le met en entier dans votre presse-papiers, ou vous pouvez l’enregistrer dans un fichier .md. Comme c’est du texte brut, le résultat s’ouvre dans n’importe quel éditeur et se colle directement dans les wikis, les applis de notes et les sites de documentation qui utilisent le Markdown.
Considérez la structure comme un premier jet
Chaque titre et chaque liste du résultat est une déduction tirée d’indices visuels. Un titre en gras à la taille du corps peut ressortir comme une ligne ordinaire, alors qu’une grande citation mise en exergue peut être promue au rang de titre. Parcourez l’aperçu avant de vous y fier, surtout pour les documents longs ou très maquettés.
Dans quels cas l’utiliser
Transférer un vieux manuel dans un wiki
Un guide produit qui n’existe plus qu’en PDF peut devenir des pages Markdown, avec ses titres de section et ses listes d’étapes intacts, prêtes à être découpées en sujets et modifiées dans votre outil de documentation.
Modifier un rapport dont le fichier source a disparu
Quand le fichier de traitement de texte d’origine est perdu, le Markdown vous rend un texte modifiable avec son plan en place. Faites vos modifications, puis générez un nouveau PDF avec Markdown en PDF.
Donner un long document à un assistant IA
Les assistants conversationnels lisent facilement le Markdown, et les marques de titre leur indiquent à quelle section appartient un paragraphe. Collez les sections utiles plutôt que de joindre tout le PDF.
Tableaux, images et pages à plusieurs colonnes
Les tableaux ne sont pas reconstruits en tableaux Markdown. Dans un PDF, un tableau n’est qu’un ensemble de mots placés à des coordonnées, sans trace des lignes ni des cellules : le contenu des cellules sort donc en lignes de texte séparées. Recréez à la main les tableaux importants, ou gardez une image fidèle de la page avec PDF en PNG.
Les images sont laissées de côté dans le Markdown. Pour garder les photos, les graphiques et les figures, enregistrez-les avec Extraire les images et ajoutez vous-même les liens vers ces fichiers dans votre Markdown.
Les mises en page à plusieurs colonnes, comme les lettres d’information et les articles scientifiques, peuvent s’entremêler, avec des lignes de colonnes voisines qui alternent. Les documents sur une seule colonne exportés depuis un traitement de texte ou une page web donnent le résultat le plus propre.
Les scans ont d’abord besoin d’une couche de texte
Un PDF scanné contient des images de pages et aucun caractère : cet outil n’a rien à lire et le Markdown sort vide. Passez le fichier dans OCR PDF, qui reconnaît les mots et ajoute une couche de texte invisible, puis revenez ici avec le nouveau fichier. L’OCR a son propre taux d’erreur : relisez les noms et les chiffres dans le résultat.
Markdown, texte brut ou images : quel résultat choisir
- Le Markdown (cet outil) quand vous voulez le plan du document : des titres, des listes et des paragraphes propres que vous pourrez continuer à modifier.
- Le texte brut de PDF en texte quand vous voulez les mots exactement tels qu’ils sont stockés, avec des repères de page et sans hypothèse sur la structure.
- Les images de PDF en PNG quand l’aspect exact de chaque page compte plus qu’un texte modifiable.
Ce qui est conservé, et où tout se passe
Les caractères sont repris exactement tels que le PDF les stocke : rien n’est perdu à cause d’une résolution ou d’une compression. Ce que le Markdown ne sait pas décrire est laissé de côté : polices, couleurs, espacements et position exacte des éléments sur la page. Le fichier .md obtenu est léger, puisqu’il ne contient que du texte et quelques symboles de mise en forme. Si le fichier est verrouillé, retirez son mot de passe avec Déverrouiller un PDF (vous devez le connaître) et convertissez la copie déverrouillée.
La conversion se fait dans cet onglet du navigateur, et ni le PDF ni le Markdown ne sont envoyés ; vous pouvez le vérifier vous-même en quelques étapes.