Aller au contenu
WoowPDF

Convertir un PDF en Markdown en ligne

Transformez un PDF en Markdown propre avec titres, gras et italique, listes, tableaux, blocs de code, liens et images en option. Gratuit, privé et dans votre navigateur.

Gratuit Fonctionne dans votre navigateur

Comment convertir un PDF en Markdown

Le PDF est fait pour l'impression, le Markdown pour écrire, modifier et réutiliser. Le convertisseur PDF en Markdown de WoowPDF reconstruit la structure de votre document en Markdown propre et lisible, à coller dans GitHub, GitLab, Obsidian, Notion, un générateur de site statique, un wiki ou un assistant IA. Il conserve titres, emphase, listes, tableaux, blocs de code et liens, et supprime les en-têtes, pieds de page et numéros de page qui encombrent le texte copié depuis un PDF. Tout se passe dans votre navigateur : vos fichiers restent sur votre appareil.

Convertir un PDF en Markdown

  1. Ajoutez votre PDF. Déposez un ou plusieurs fichiers sur la page ou cliquez sur Choisir des fichiers.
  2. Choisissez ce qu'il faut détecter. Titres, tableaux et suppression des en-têtes et pieds de page sont activés par défaut. Activez Extraire les images si vous voulez aussi les illustrations.
  3. Affinez si besoin. Dans les options avancées, vous pouvez marquer les sauts de page par une ligne ou un commentaire HTML, ajouter un en-tête YAML avec titre et auteur, ou ne convertir qu'une plage de pages.
  4. Convertissez et téléchargez. Cliquez sur Convertir en Markdown et téléchargez votre fichier .md (ou un ZIP avec le dossier images).

La structure, pas seulement le texte

Copier le texte d'un PDF donne souvent des lignes coupées, des titres perdus et des numéros de page au milieu des phrases. Ce convertisseur s'appuie au contraire sur la position et la police de chaque morceau de texte. Les lignes sont regroupées en paragraphes et les mots coupés en fin de ligne sont recollés. La taille du texte courant est mesurée et les lignes plus grandes deviennent des titres #, ## ou ###. Les mots en gras et en italique gardent leur emphase, le texte à chasse fixe devient du code en ligne ou un bloc de code, et les liens deviennent de vrais liens Markdown.

Listes et tableaux

Les puces comme •, ▪, – et * deviennent des éléments de liste Markdown, les éléments numérotés restent numérotés et les éléments en retrait sont imbriqués. Les lignes de texte réparties en colonnes alignées deviennent des tableaux Markdown façon GitHub avec une ligne d'en-tête, bien affichés sur GitHub, dans Obsidian et dans la plupart des outils de documentation. Pour les tableaux à cellules fusionnées, vérifiez le résultat et ajustez-le à la main.

Un résultat propre sur de vrais documents

Rapports, articles et manuels répètent le même en-tête, pied de page et numéro sur chaque page. WoowPDF détecte ces éléments répétés et les supprime : vos paragraphes s'enchaînent sans interruption et une phrase qui continue sur la page suivante reste entière. Les mises en page sur deux colonnes, courantes dans les articles scientifiques et les lettres d'information, sont lues colonne par colonne et non ligne par ligne à travers la page.

Des images dans un dossier prêt à l'emploi

Avec Extraire les images, vous recevez un fichier ZIP contenant le document Markdown et un dossier images. Chaque image est liée par un chemin relatif à l'endroit où elle apparaît dans le PDF : le document s'affiche correctement dès la décompression. Les logos répétés sur chaque page sont ignorés.

Idéal pour l'IA, la documentation et les notes

Le Markdown est compact et garde un sens que le texte brut perd, ce qui en fait un excellent format pour fournir des documents à ChatGPT, Claude ou à une chaîne RAG. C'est aussi le format natif de bases de connaissances comme Obsidian et Logseq, des fichiers README et des sites de documentation construits avec Docusaurus, MkDocs ou Hugo.

Conseils pour un résultat optimal

Fonctionnalités

  • Titres détectés d'après la taille du texte et convertis en #, ## et ###
  • Gras, italique et code en ligne conservés
  • Listes à puces et numérotées, y compris imbriquées
  • Tableaux reconstruits au format Markdown de GitHub
  • Texte à chasse fixe converti en blocs de code
  • Liens conservés, en-têtes, pieds de page et numéros répétés supprimés
  • Mises en page sur deux colonnes lues dans le bon ordre
  • Extraction d'images en option, dans un ZIP avec un dossier images
  • Confidentiel : le PDF est converti dans votre navigateur, sans envoi

Questions fréquentes

Qu'est-ce que le Markdown ?

Le Markdown est un format de texte brut qui utilise des symboles simples pour la structure : # pour les titres, * pour l'emphase, - pour les listes et | pour les tableaux. Il est utilisé par GitHub, GitLab, Obsidian, Notion, les générateurs de sites statiques, les outils de documentation et les assistants IA.

Quels éléments de mon PDF sont conservés ?

Titres, paragraphes, gras et italique, listes à puces et numérotées, tableaux simples, code à chasse fixe, liens et, si vous l'activez, images. Les en-têtes, pieds de page et numéros de page répétés sont supprimés.

Mon PDF est-il envoyé sur un serveur ?

Non. La conversion se fait entièrement dans votre navigateur. Votre fichier ne quitte jamais votre appareil.

Cela fonctionne-t-il avec un PDF numérisé ?

Un PDF numérisé ne contient que des images de texte. Passez-le d'abord dans notre outil OCR PDF pour ajouter une couche de texte, puis convertissez le résultat en Markdown.

Comment les titres sont-ils détectés ?

Le convertisseur repère la taille de police du texte courant. Les lignes plus grandes deviennent des titres : la plus grande taille devient #, la suivante ##, les plus petites ###. Vous pouvez désactiver cette détection.

Les tableaux sont-ils convertis ?

Oui. Les lignes dont le texte est réparti en colonnes alignées deviennent des tableaux Markdown avec une ligne d'en-tête. Les tableaux très complexes avec cellules fusionnées peuvent demander une retouche.

Que deviennent les images ?

Par défaut, seul le texte est converti. Activez Extraire les images pour obtenir un ZIP avec le fichier .md et un dossier images ; chaque image est liée à l'endroit où elle apparaît.

Puis-je utiliser le résultat avec ChatGPT, Claude ou d'autres IA ?

Oui. Le Markdown est l'un des meilleurs formats pour fournir des documents aux modèles de langage : il garde la structure tout en restant compact.

Les documents sur deux colonnes sont-ils gérés ?

Oui. Quand une page comporte deux colonnes de texte, la colonne de gauche est lue avant celle de droite, sans mélanger les lignes.

Puis-je convertir plusieurs PDF à la fois ?

Oui. Ajoutez plusieurs fichiers : chacun est converti avec les mêmes réglages. Téléchargez-les séparément ou ensemble en ZIP.