Markdown es el formato cotidiano de las wikis, los sitios de documentación y las aplicaciones de notas. Cuando un PDF tiene que pasar a ese mundo, volver a teclearlo es la opción lenta. PDF a Markdown extrae el texto de cada página a un archivo .md, con un título que marca el inicio de cada página, para que tengas una base editable que estructurar y enlazar.
Cómo usar PDF a Markdown
- Añade el PDF. Los PDF escaneados necesitan OCR antes.
- Pulsa Convertir a Markdown.
- Descarga el archivo .md.
- Añade títulos, listas y enlaces para estructurar el contenido.
Qué contiene el archivo Markdown
Cada página del PDF empieza con un título de nivel uno como «Page 1», seguido del texto extraído de esa página. Los títulos de página permiten ver fácilmente de dónde procede el contenido y cotejarlo con el PDF. El archivo es texto plano UTF-8, así que se abre en cualquier editor y en herramientas como Obsidian, GitHub, sitios de documentación y generadores de sitios estáticos sin ningún paso de conversión.
La estructura la añades tú
VelloDoc no intenta adivinar la estructura: no detecta títulos dentro de una página, negritas, listas, tablas ni enlaces, y el texto llega como líneas y párrafos sencillos. Es algo deliberado, porque una estructura adivinada suele estar mal y cuesta más corregirla que añadirla. Unos minutos convirtiendo los títulos reales con símbolos # y pasando líneas a listas suelen dar un documento limpio. Sustituye los títulos de página por títulos con sentido cuando el contenido esté organizado.
Conversiones relacionadas
Para texto sin marcas de Markdown, PDF a TXT genera un archivo plano, y para editar en un procesador de textos, PDF a Word conserva los saltos de página. Los PDF escaneados necesitan antes OCR PDF. Cuando tu Markdown esté listo, Markdown a PDF lo vuelve a convertir en un documento con formato. La guía de formatos explica cuándo Markdown es el sitio adecuado para el contenido.
Cuándo se usa PDF a Markdown
Pasar documentos a una wiki
Lleva políticas y procedimientos que solo existen como PDF a la wiki de un equipo como páginas editables.
Notas en aplicaciones de Markdown
Importa artículos y trabajos a una aplicación de notas en Markdown para resaltarlos, enlazarlos y anotarlos.
Borradores de documentación
Empieza la documentación de un sitio web o un repositorio a partir del texto de un manual en PDF existente.
Limitaciones que conviene conocer
PDF a Markdown solo añade títulos de página y el texto extraído; no detecta títulos, listas, tablas, enlaces ni imágenes dentro de las páginas. Los PDF escaneados necesitan OCR antes, y el texto a varias columnas puede reordenarse.
PDF a Markdown: preguntas frecuentes
¿Se detectan títulos y listas?
No. Cada página recibe un título, y su texto sigue como líneas sencillas. Añade la estructura tú mismo donde importe.
¿Por qué el archivo solo contiene títulos de página?
El PDF no tiene capa de texto, normalmente porque es un escaneo. Pasa antes OCR PDF y vuelve a convertir.
¿Se incluyen las imágenes?
No. Guarda las imágenes por separado con Extraer imágenes y enlázalas desde tu Markdown.
¿Qué variante de Markdown se usa?
Solo se añaden títulos estándar, así que el archivo funciona en todas las variantes y herramientas de Markdown.