El motivo más habitual para pasar un PDF a Word es reutilizar sus palabras: citar un informe, actualizar un contrato antiguo o editar un documento cuyo archivo original se ha perdido. PDF a Word extrae el texto de cada página a un archivo DOCX editable y conserva los párrafos y los saltos de página. Es honesto sobre lo que es: una herramienta de recuperación de texto, no un conversor de maquetación.
Cómo usar PDF a Word
- Añade el PDF. Si es un escaneo, pásale antes OCR PDF.
- Pulsa Convertir a Word.
- Descarga el DOCX y ábrelo en Word, LibreOffice o Google Docs.
- Vuelve a aplicar títulos, tablas e imágenes donde los necesites.
Qué contiene el DOCX
El documento empieza con un título creado a partir del nombre del archivo. A continuación va el texto de cada página del PDF como párrafos normales, separados allí donde el PDF tiene una línea en blanco entre bloques de texto, y cada página del PDF empieza en una página nueva de Word. Así obtienes un texto limpio y editable, fácil de volver a maquetar, en lugar de una imitación frágil del diseño original hecha con cuadros de texto flotantes que se desmontan en cuanto los editas.
Qué no se reconstruye
No se recrean las fuentes, los colores, las columnas, las tablas, las imágenes, los encabezados, los pies de página ni la numeración de las notas. Las páginas a varias columnas pueden salir con las columnas leídas una tras otra, y las celdas de las tablas se convierten en líneas de texto. Si el documento tiene que seguir pareciéndose al original, suele ser más práctico añadir tus cambios al PDF con Añadir texto a PDF. La guía de formatos explica por qué es difícil convertir el diseño de un PDF en un documento editable.
Los PDF escaneados necesitan OCR antes
Un escaneo no tiene capa de texto, solo imágenes de texto, así que convertirlo directamente produce un documento con el título y páginas vacías. Pasa antes OCR PDF para añadir el texto reconocido y después convierte el resultado. Para texto sin formato de Word, PDF a TXT es más rápido, y qué hace que un PDF se pueda buscar explica las capas de texto.
Cuándo se usa PDF a Word
Reutilizar el texto de un informe
Lleva pasajes, cifras y conclusiones a un documento nuevo sin volver a teclearlos desde el PDF.
Actualizar un contrato antiguo
Empieza un acuerdo revisado a partir del texto de un PDF firmado cuando el archivo de Word original ya no existe.
Recuperar un original perdido
Reconstruye una versión editable de un documento que ahora solo existe como PDF adjunto.
Limitaciones que conviene conocer
PDF a Word solo recupera el texto y los saltos de párrafo. No se reconstruyen el diseño, las fuentes, las tablas, las imágenes, los encabezados ni los pies de página, y el texto a varias columnas puede reordenarse. Los PDF escaneados necesitan OCR antes, y la herramienta requiere python-docx en el servidor.
PDF a Word: preguntas frecuentes
¿Mi documento de Word se verá como el PDF?
No. El texto se recupera como párrafos editables, pero el diseño, las fuentes, las imágenes y las tablas no se reconstruyen, así que cuenta con tener que volver a darle formato.
¿Por qué mi DOCX está vacío?
Probablemente el PDF es un escaneo sin capa de texto. Pásale antes OCR PDF y después convierte el resultado.
¿Se incluyen las imágenes?
No. Usa Extraer imágenes para guardarlas por separado e insértalas tú en el documento.
¿Por qué esta herramienta no está disponible en algunos servidores?
Necesita el paquete python-docx en el servidor. Cuando falta, la herramienta lo indica claramente.