Convertir un PDF en Markdown

Extrayez le texte d'un PDF et obtenez un fichier Markdown avec une détection automatique des titres selon la taille de police, prêt à coller dans un README, une note ou un article.

Glissez-déposez un fichier .pdf ici, ou cliquez pour parcourir (max 60 Mo).

Comment ça marche

Le PDF est lu page par page avec pdf.js, qui donne accès à la position et à la taille de chaque fragment de texte. Ces fragments sont regroupés en lignes, puis la taille de police médiane du document sert de référence : une ligne nettement plus grande que cette référence est considérée comme un titre (#, ## ou ### selon l'écart), et les lignes commençant par une puce deviennent des éléments de liste Markdown.

La détection des titres est-elle fiable à 100% ?

Non : elle repose sur une heuristique de taille de police relative, pas sur une analyse sémantique du document. Un PDF dont tous les titres ont la même taille que le texte courant, ou une mise en page atypique, peut donner des niveaux de titre incorrects — une relecture rapide du Markdown généré est recommandée avant réutilisation.

Les tableaux et images sont-ils convertis ?

Non, seul le texte est extrait et restructuré ; les tableaux perdent leur alignement en colonnes et les images ne sont pas incluses dans le Markdown généré.

Traitement 100% local : l'extraction et la conversion s'exécutent entièrement dans votre navigateur via pdf.js, sans transmission de votre document à un serveur.