VelloDoc
Convertir desde PDF

Sacar el contenido de un PDF: texto, datos, imágenes y archivo

Un PDF está pensado para leerse, no para reutilizarse. Registra dónde está cada carácter e imagen en la página, pero no los párrafos, tablas y estilos del documento del que salió. Recuperar el contenido depende, por tanto, de lo que realmente necesites: las palabras, las cifras, las imágenes, una versión web o un archivo a largo plazo. Esta guía explica qué puede recuperar cada conversión y qué no, para que elijas la opción que da el resultado más útil con la menor limpieza posterior.

Herramientas: Convertir desde PDF

Herramientas en esta área: 12. Cada una enlaza a una página detallada con sus ajustes, límites y preguntas frecuentes.

PDF a JPG

Convierte cada página de un PDF en una imagen JPG a 120, 150 o 200 DPI, descargadas juntas en un ZIP.

Convertir desde PDF

PDF a PNG

Convierte las páginas de un PDF en imágenes PNG sin pérdida, con texto y líneas nítidos, ideal para documentación y diagramas.

Convertir desde PDF

PDF a WebP

Convierte las páginas de un PDF en imágenes WebP ligeras para vistas previas web, menús online y catálogos en apps.

Convertir desde PDF

PDF a Word

Recupera el texto de un PDF como un DOCX editable con párrafos y saltos de página, listo para darle formato.

Convertir desde PDF

PDF a Excel

Extrae las líneas de texto de las páginas PDF a un libro XLSX, separando columnas donde el texto tiene espacios amplios.

Convertir desde PDF

PDF a PowerPoint

Coloca cada página del PDF en su propia diapositiva como imagen de alta resolución, con el tamaño adaptado a la página.

Convertir desde PDF

PDF a TXT

Extrae todo el texto legible de un PDF a un archivo de texto plano UTF-8 para citar, buscar o analizar.

Convertir desde PDF

PDF a Markdown

Extrae el texto del PDF a un archivo Markdown con un título por página, un punto de partida para wikis y notas.

Convertir desde PDF

PDF a HTML

Convierte un PDF en una única página HTML autónoma con texto real que se adapta a la pantalla e imágenes integradas.

Convertir desde PDF

Extraer imágenes

Guarda las fotos y los gráficos incrustados en un PDF en su formato y resolución originales, sin capturas de pantalla.

Convertir desde PDF

PDF a PDF/A

Reescribe un PDF como archivo de conservación PDF/A-2 autónomo, con fuentes incrustadas y perfil de color sRGB.

Convertir desde PDF

Espacio de trabajo PDF con IA

Busca y haz preguntas en varios PDF a la vez. Compara fechas, importes y cláusulas, detecta contradicciones y obtén un solo resumen.

Convertir desde PDF

Por qué es difícil convertir un PDF de vuelta

En la mayoría de los PDF, el texto se guarda como caracteres colocados en posiciones exactas de la página. A menudo no queda constancia de que un grupo de líneas forma un párrafo, de que ciertas palabras son un título o de que una cuadrícula de números es una tabla con filas y columnas. Un conversor tiene que reconstruir esa estructura a partir de las posiciones, lo que funciona bien con documentos sencillos y mal con diseños complejos. Los PDF escaneados son aún más difíciles, porque no contienen ningún carácter, solo imágenes de páginas. Por eso el camino más fiable es siempre el archivo de origen cuando existe, y por eso los conversores de VelloDoc priorizan un resultado limpio y honesto frente a imitaciones del diseño original. La guía de formatos explica los compromisos de fondo.

Recuperar las palabras

Tres conversores recuperan texto para destinos distintos. PDF a Word genera un DOCX editable con el texto de cada página en párrafos y con los saltos de página conservados, listo para darle formato, pero no reconstruye fuentes, tablas, imágenes ni columnas. PDF a TXT escribe todo el texto en un archivo UTF-8, la forma más portátil para citar, buscar y analizar. PDF a Markdown añade un título por cada página, un punto de partida cómodo para wikis y aplicaciones de notas. Si el resultado sale ilegible aunque la página se lea con normalidad, el PDF guarda los caracteres sin una correspondencia correcta con las letras; ejecutar el OCR y volver a convertir suele solucionarlo.

Recuperar cifras y tablas

PDF a Excel crea una hoja por página, convierte cada línea de texto en una fila y separa las celdas allí donde el texto tiene un tabulador o un hueco amplio, que es como muchos PDF distribuyen las columnas. Las tablas sencillas y con espaciado uniforme se convierten bien; las celdas combinadas, el texto ajustado y las celdas vacías necesitan retoques, porque el espaciado es la única pista de la estructura. Los valores llegan como texto, así que conviértelos en números antes de calcular. Para datos que salieron originalmente de una exportación de un sistema, pedir el CSV siempre es más preciso que extraerlos de un PDF, y CSV a PDF cubre el camino contrario cuando necesitas una tabla imprimible.

Imágenes de las páginas o las imágenes que contienen

Hay dos tareas que se confunden con facilidad. Generar imágenes de páginas produce imágenes de páginas completas: PDF a JPG, PDF a PNG y PDF a WebP convierten cada página a 120, 150 o 200 DPI y entregan un ZIP; JPG es adecuado para fotos, PNG para texto y diagramas, y WebP para sitios web. Extraer imágenes, en cambio, saca las fotos y gráficos guardados dentro del PDF en su formato y resolución originales, lo que puede dar mucha más calidad que una imagen de la página. Para presentar páginas, PDF a PowerPoint coloca cada página en una diapositiva del tamaño de la página, como una imagen que puedes anotar pero no editar.

Un PDF como página web

Los PDF largos son incómodos en el móvil y opacos para los buscadores. PDF a HTML convierte un documento en una única página web autónoma: las páginas con capa de texto pasan a ser texto real que se adapta a la pantalla y se puede seleccionar, buscar y leer en voz alta, con sus imágenes incrustadas, mientras que las páginas escaneadas se incluyen como imágenes de página para no perder nada. El diseño exacto, las columnas y las fuentes se simplifican en favor de la legibilidad. Para sitios de documentación que usan Markdown, el conversor a Markdown encaja mejor, y publicar el PDF original junto al HTML mantiene disponible una versión imprimible para quien la quiera.

Los escaneos necesitan OCR primero

Toda conversión basada en texto depende de una capa de texto. Un PDF escaneado o fotografiado no la tiene, así que PDF a Word devuelve páginas vacías, PDF a Excel devuelve hojas vacías y PDF a HTML recurre a imágenes de página. OCR PDF añade texto reconocido en cualquiera de 39 idiomas, y a partir de ahí todos los conversores de texto funcionan con normalidad. El reconocimiento no es perfecto, sobre todo con letra pequeña, escritura a mano y diseños complejos, así que revisa nombres, cifras y fechas en el resultado convertido. Limpiar los escaneos antes del reconocimiento con las herramientas de optimización para enderezar y quitar páginas en blanco mejora la precisión de forma apreciable, y qué hace que un PDF se pueda buscar explica por qué.

Respuestas de muchos PDF a la vez

A veces no necesitas convertir nada. Necesitas una respuesta que está repartida entre varios archivos. El Espacio de trabajo PDF con IA lee el texto de hasta 20 PDF para que puedas buscar en todos a la vez, en tu navegador. También puede pedir a Claude, un modelo de IA creado por Anthropic, que compare los documentos, liste en qué no coinciden o escriba un resumen, con el nombre del archivo y el número de página de cada dato. La búsqueda es gratuita y no sale de tu navegador. Las respuestas de la IA envían el texto a Anthropic solo cuando preguntas y aceptas, así que comprueba cada referencia de página antes de fiarte.

Archivar en lugar de convertir

A veces el objetivo no es reutilizar el contenido, sino mantener el documento legible durante décadas. PDF a PDF/A reescribe un archivo según el estándar de archivo PDF/A-2 con Ghostscript, incrustando las fuentes y un perfil de color sRGB para que el archivo no dependa de nada externo. Ningún conversor puede garantizar que cualquier archivo supere una validación estricta, así que comprueba el resultado con un validador como veraPDF cuando el cumplimiento sea obligatorio. Repara antes los archivos dañados con Reparar PDF, dale al documento un título significativo con Ver y editar metadatos y haz buscables los escaneos antes de archivarlos para que sigan siendo fáciles de encontrar.

Flujos de trabajo habituales

Reutilizar el texto de un informe escaneado

Añade una capa de texto a un informe escaneado y recupera después sus párrafos como un documento de Word editable que puedas citar y volver a formatear.

Pasar una lista de precios a una hoja de cálculo

Haz buscable una lista de precios escaneada o impresa y lleva después sus filas a un libro donde puedas limpiar y comparar los precios.

Revisar un contrato y sus anexos

Haz buscables los anexos escaneados y pregunta qué fechas, importes y condiciones se aplican ahora, con una referencia de página para cada respuesta.

Publicar un informe como contenido web

Convierte un informe en una página web adaptable, guarda sus fotos originales para tu sitio y crea vistas previas de las páginas para el enlace de descarga.

Archivar registros correctamente

Reconstruye un archivo dañado, dale un título y un autor claros y conviértelo a PDF/A para conservarlo a largo plazo.

Preguntas sobre cómo convertir PDF a otros formatos

¿Se puede convertir un PDF de nuevo en un archivo de Word idéntico?

Rara vez. Los PDF registran posiciones, no la estructura del documento, así que los conversores recuperan el texto con fiabilidad, pero no el diseño exacto. Usa el archivo de origen siempre que lo tengas.

¿Por qué mis conversiones salen vacías?

Casi seguro que el PDF es un escaneo sin capa de texto. Ejecuta primero OCR PDF y después convierte el resultado.

¿Qué diferencia hay entre PDF a PNG y Extraer imágenes?

PDF a PNG genera imágenes de páginas completas. Extraer imágenes guarda las fotos y gráficos individuales almacenados dentro del PDF, en su formato y resolución originales.

¿Qué conversión es mejor para reutilizar tablas?

PDF a Excel da ventaja con tablas sencillas. Para datos precisos, pide el CSV o la hoja de cálculo original a partir de la que se creó el PDF.

¿Convertir cambia mi PDF original?

No. Cada conversión crea un archivo nuevo, y la copia temporal del servidor se elimina cuando termina la descarga.

Guías relacionadas