Le Markdown est le format courant des wikis, des sites de documentation et des applications de prise de notes. Quand un PDF doit entrer dans cet univers, tout ressaisir est l’option lente. PDF en Markdown extrait le texte de chaque page dans un fichier .md, avec un titre marquant le début de chaque page : vous disposez d’une base modifiable à structurer et à relier.
Comment utiliser PDF en Markdown
- Ajoutez le PDF. Les PDF numérisés ont d’abord besoin de l’OCR.
- Cliquez sur Convertir en Markdown.
- Téléchargez le fichier .md.
- Ajoutez titres, listes et liens pour structurer le contenu.
Ce que contient le fichier Markdown
Chaque page du PDF commence par un titre de premier niveau comme « Page 1 », suivi du texte extrait de cette page. Les titres de page permettent de voir facilement d’où provient le contenu et de le comparer au PDF. Le fichier est du texte brut UTF-8 : il s’ouvre dans n’importe quel éditeur et dans des outils comme Obsidian, GitHub, les sites de documentation et les générateurs de sites statiques, sans étape de conversion.
La structure, c’est vous qui l’ajoutez
VelloDoc ne devine pas la structure : titres internes à une page, gras, listes, tableaux et liens ne sont pas détectés, et le texte arrive sous forme de lignes et de paragraphes simples. C’est volontaire, car une structure devinée est souvent fausse et plus difficile à corriger qu’à ajouter. Quelques minutes passées à transformer les vrais titres avec des # et les lignes en listes suffisent généralement à obtenir un document propre. Remplacez les titres de page par des titres parlants une fois le contenu organisé.
Conversions associées
Pour du texte sans aucun balisage Markdown, PDF en TXT produit un fichier brut, et pour une modification dans un traitement de texte, PDF en Word conserve les sauts de page. Les PDF numérisés ont d’abord besoin de OCR PDF. Une fois votre Markdown prêt, Markdown en PDF le retransforme en document mis en forme. Le guide des formats indique quand le Markdown est le bon format pour un contenu.
Quand utiliser PDF en Markdown
Transférer des documents dans un wiki
Faites entrer dans le wiki d’une équipe, sous forme de pages modifiables, des politiques et procédures qui n’existent qu’en PDF.
Notes dans des applications Markdown
Importez articles et publications dans une application de notes Markdown pour les surligner, les relier et les annoter.
Brouillons de documentation
Démarrez la documentation d’un site ou d’un dépôt à partir du texte d’un manuel PDF existant.
Limites à connaître
PDF en Markdown ajoute uniquement des titres de page et le texte extrait ; il ne détecte ni titres, ni listes, ni tableaux, ni liens, ni images à l’intérieur des pages. Les PDF numérisés ont d’abord besoin de l’OCR, et le texte sur plusieurs colonnes peut être réordonné.
PDF en Markdown : questions fréquentes
Les titres et les listes sont-ils détectés ?
Non. Chaque page reçoit un titre, et son texte suit sous forme de lignes simples. Ajoutez vous-même la structure là où elle compte.
Pourquoi le fichier ne contient-il que des titres de page ?
Le PDF n’a pas de couche de texte, généralement parce qu’il s’agit d’une numérisation. Passez-le d’abord dans OCR PDF, puis relancez la conversion.
Les images sont-elles incluses ?
Non. Enregistrez les images séparément avec Extraire les images et liez-les depuis votre Markdown.
Quelle variante de Markdown est utilisée ?
Seuls des titres standard sont ajoutés : le fichier fonctionne dans toutes les variantes et tous les outils Markdown.