Aller au contenu

↑ ↓ pour naviguer · Entrée pour ouvrir · Échap pour fermer

Convertir un PDF en Markdown

Reconstruisez le texte d’un PDF en Markdown, avec des titres, des listes et des paragraphes prêts à modifier. Votre fichier est analysé sur cet appareil, sans aucun envoi.

Tout se passe sur votre appareil : aucun fichier n’est envoyé. Comment le vérifier

Déposez un PDF ici ou choisissez des fichiers Un PDF à la fois

En bref

CommonMark, la spécification précise du Markdown, aujourd’hui en version 0.31.2, garde la structure dans du texte brut : # marque un titre et - un élément de liste. pd00 lit la couche de texte d’un PDF avec pdf.js et écrit un fichier .md où les lignes au moins 12 % plus grandes que le corps du texte deviennent des titres # à ###, les lignes à puces ou numérotées deviennent des listes, et chaque saut de page devient une ligne ---.

Mode d’emploi : PDF en Markdown

  1. Chargez un PDF qui contient du texteChoisissez un PDF ou déposez-le sur l’outil. Il lui faut une couche de texte : si vous ne pouvez pas surligner de mots dans votre lecteur PDF, le fichier est un scan et doit d’abord passer par OCR PDF.
  2. Relisez l’aperçuLe Markdown reconstruit s’affiche sur la page. Vérifiez que les titres et les listes sont là où vous les attendez, en particulier dans les documents avec des colonnes ou des tableaux.
  3. Copiez-le ou gardez le .mdAppuyez sur « Copier le texte » pour coller le Markdown dans un éditeur, un wiki ou une messagerie, ou téléchargez-le en fichier .md pour le ranger avec vos autres notes.

Un exemple concret

Un guide de deux pages, guide.pdf, compose son corps de texte en 10 pt, le titre en 18 pt, les titres de section en 14 pt et les sous-titres en 12 pt, avec des étapes marquées par « • ». Le fichier guide.md obtenu contient :

  • # pour le titre en 18 pt, ## pour les titres en 14 pt et ### pour les sous-titres en 12 pt (12 ÷ 10 = 1,2, au-dessus du seuil de 1,12) ;
  • - à la place de chaque « • » ;
  • une ligne --- là où commence la page 2.

Une ligne en 11 pt reste du corps de texte (11 ÷ 10 = 1,1). Exception : une ligne en gras de moins de 80 caractères, qui n’est pas un élément de liste et ne se termine ni par un point, ni par deux-points, ni par un point-virgule, ni par une virgule, devient elle aussi un titre ###.

Ce que fait l’outil, et ses limites

  • Il faut une couche de texte : un scan ne produit aucun Markdown tant que OCR PDF ne lui en a pas ajouté une.
  • Les tableaux deviennent de simples lignes, et non des tableaux GitHub Flavored Markdown, et les images sont ignorées ; enregistrez-les avec Extraire les images.
  • Trois niveaux de titre seulement : une quatrième taille de titre, ou plus petite, est elle aussi écrite en ###.
  • Le gras, l’italique et les liens ne sont pas balisés, et les mises en page à deux colonnes peuvent entremêler les lignes de colonnes voisines.

Sources

Liens vérifiés le 10 octobre 2026.

PDF en Markdown : ce qu’il faut savoir

Un PDF enregistre où se trouve chaque morceau de texte sur la page et quelle est sa taille, mais il indique rarement quelle ligne est un titre ou quelles lignes forment une liste. Ce convertisseur lit la couche de texte avec pdf.js, fait lui-même ces choix, puis écrit le résultat en Markdown :

  • Les titres sont déduits du texte composé dans une police plus grande que le corps.
  • Les listes viennent des lignes qui commencent par une puce ou un numéro, transformées en éléments à puces ou numérotés.
  • Les paragraphes sont recollés : les lignes que le PDF a coupées à la marge droite se rejoignent, pour éviter un retour à la ligne forcé tous les dix ou douze mots.
  • Les sauts de page sont marqués par une ligne horizontale, ---.

Le Markdown apparaît dans un aperçu sur la page. Un bouton Copier le texte le met en entier dans votre presse-papiers, ou vous pouvez l’enregistrer dans un fichier .md. Comme c’est du texte brut, le résultat s’ouvre dans n’importe quel éditeur et se colle directement dans les wikis, les applis de notes et les sites de documentation qui utilisent le Markdown.

Considérez la structure comme un premier jet

Chaque titre et chaque liste du résultat est une déduction tirée d’indices visuels. Un titre en gras à la taille du corps peut ressortir comme une ligne ordinaire, alors qu’une grande citation mise en exergue peut être promue au rang de titre. Parcourez l’aperçu avant de vous y fier, surtout pour les documents longs ou très maquettés.

Dans quels cas l’utiliser

  • Transférer un vieux manuel dans un wiki

    Un guide produit qui n’existe plus qu’en PDF peut devenir des pages Markdown, avec ses titres de section et ses listes d’étapes intacts, prêtes à être découpées en sujets et modifiées dans votre outil de documentation.

  • Modifier un rapport dont le fichier source a disparu

    Quand le fichier de traitement de texte d’origine est perdu, le Markdown vous rend un texte modifiable avec son plan en place. Faites vos modifications, puis générez un nouveau PDF avec Markdown en PDF.

  • Donner un long document à un assistant IA

    Les assistants conversationnels lisent facilement le Markdown, et les marques de titre leur indiquent à quelle section appartient un paragraphe. Collez les sections utiles plutôt que de joindre tout le PDF.

Tableaux, images et pages à plusieurs colonnes

Les tableaux ne sont pas reconstruits en tableaux Markdown. Dans un PDF, un tableau n’est qu’un ensemble de mots placés à des coordonnées, sans trace des lignes ni des cellules : le contenu des cellules sort donc en lignes de texte séparées. Recréez à la main les tableaux importants, ou gardez une image fidèle de la page avec PDF en PNG.

Les images sont laissées de côté dans le Markdown. Pour garder les photos, les graphiques et les figures, enregistrez-les avec Extraire les images et ajoutez vous-même les liens vers ces fichiers dans votre Markdown.

Les mises en page à plusieurs colonnes, comme les lettres d’information et les articles scientifiques, peuvent s’entremêler, avec des lignes de colonnes voisines qui alternent. Les documents sur une seule colonne exportés depuis un traitement de texte ou une page web donnent le résultat le plus propre.

Les scans ont d’abord besoin d’une couche de texte

Un PDF scanné contient des images de pages et aucun caractère : cet outil n’a rien à lire et le Markdown sort vide. Passez le fichier dans OCR PDF, qui reconnaît les mots et ajoute une couche de texte invisible, puis revenez ici avec le nouveau fichier. L’OCR a son propre taux d’erreur : relisez les noms et les chiffres dans le résultat.

Markdown, texte brut ou images : quel résultat choisir

  • Le Markdown (cet outil) quand vous voulez le plan du document : des titres, des listes et des paragraphes propres que vous pourrez continuer à modifier.
  • Le texte brut de PDF en texte quand vous voulez les mots exactement tels qu’ils sont stockés, avec des repères de page et sans hypothèse sur la structure.
  • Les images de PDF en PNG quand l’aspect exact de chaque page compte plus qu’un texte modifiable.

Ce qui est conservé, et où tout se passe

Les caractères sont repris exactement tels que le PDF les stocke : rien n’est perdu à cause d’une résolution ou d’une compression. Ce que le Markdown ne sait pas décrire est laissé de côté : polices, couleurs, espacements et position exacte des éléments sur la page. Le fichier .md obtenu est léger, puisqu’il ne contient que du texte et quelques symboles de mise en forme. Si le fichier est verrouillé, retirez son mot de passe avec Déverrouiller un PDF (vous devez le connaître) et convertissez la copie déverrouillée.

La conversion se fait dans cet onglet du navigateur, et ni le PDF ni le Markdown ne sont envoyés ; vous pouvez le vérifier vous-même en quelques étapes.

Questions fréquentes

Comment convertir un PDF en Markdown ?

Ajoutez le PDF ici : le Markdown apparaît dans l’aperçu. Appuyez sur Copier le texte ou enregistrez-le dans un fichier .md.

Pourquoi le Markdown obtenu est-il vide ?

Il n’y avait aucun caractère à lire : le fichier est très probablement un scan ou une série de photos enregistrées en PDF. Rendez-le consultable avec OCR PDF, puis convertissez le résultat.

Les tableaux sont-ils convertis en tableaux Markdown ?

Non. Les PDF ne stockent pas les tableaux en lignes et en cellules : le texte de chaque cellule sort donc en ligne ordinaire, que vous pouvez réorganiser en tableau à la main.

Que deviennent les images et les graphiques ?

Ils sont omis du Markdown. Utilisez Extraire les images pour enregistrer à part les images incorporées.

Pourquoi une ligne normale est-elle devenue un titre ?

Les titres sont déduits de la taille de police : toute ligne imprimée nettement plus grande que le corps du texte, comme une citation en exergue ou un grand chiffre, peut être marquée comme titre. Supprimez les caractères # pour la remettre en paragraphe.

Que signifient les lignes --- entre les sections ?

Chacune marque l’endroit où une nouvelle page commençait dans le PDF. Gardez-les comme séparateurs ou supprimez-les pour obtenir un texte continu.

Le PDF est-il envoyé pendant la conversion ?

Non. pdf.js lit le fichier dans votre navigateur et le Markdown est construit sur votre appareil. Voici comment le vérifier.

Dernière mise à jour :