Convertidor de PDF a Word
Sube un PDF y obtén un documento Word (.docx) editable con el texto extraído de cada página, listo para descargar. La extracción usa pdf.js y la generación del .docx usa la librería docx, ambas ejecutándose por completo en tu navegador, sin subir tu archivo a ningún servidor.
Cómo funciona
- Selecciona un archivo PDF desde tu equipo con el selector de archivos.
- pdf.js extrae el texto de cada página, reconstruyendo las líneas a partir de la posición de los fragmentos de texto del PDF.
- Cada línea detectada se convierte en un párrafo dentro del documento Word, y se inserta un salto de página antes del primer párrafo de cada página nueva.
- La librería docx construye un archivo .docx válido a partir de esos párrafos, directamente en el navegador.
- Descarga el documento Word resultante con un clic.
Casos de uso
- Reutilizar el contenido de un PDF (un informe, un artículo, un contrato) en un documento Word editable.
- Extraer texto de un PDF para reescribirlo, traducirlo o adaptarlo sin tener que retipear todo el contenido.
- Recuperar el texto de un PDF cuando ya no se tiene el archivo Word original.
- Preparar el contenido de un PDF para pegarlo en otro editor o sistema de gestión documental.
Casos de uso
- Reutilizar el contenido de un PDF (un informe, un artículo, un contrato) en un documento Word editable.
- Extraer texto de un PDF para reescribirlo, traducirlo o adaptarlo sin tener que retipear todo el contenido.
- Recuperar el texto de un PDF cuando ya no se tiene el archivo Word original.
- Preparar el contenido de un PDF para pegarlo en otro editor o sistema de gestión documental.
Errores comunes
- Subir un PDF escaneado (una foto o imagen del texto) esperando obtener un Word con el texto extraído.Esta herramienta solo extrae texto de PDFs que ya contienen una capa de texto real; no hace OCR. Si tu PDF es un escaneo sin capa de texto, el resultado saldrá vacío o casi vacío.
- Esperar que el documento Word conserve el diseño visual, las imágenes y las tablas del PDF original.La herramienta extrae únicamente el texto y lo organiza en párrafos con un salto de página por cada página del PDF; el diseño, las imágenes y las tablas no se reproducen. Sirve para reutilizar el contenido, no para recrear el documento visualmente.
- Esperar que el orden de lectura sea exacto en un PDF con columnas o tablas complejas.El orden de los párrafos se reconstruye a partir de la posición reportada por pdf.js, lo cual es una aproximación razonable pero no siempre coincide exactamente con el flujo de lectura original en diseños complejos. Revisa y reordena el texto en Word si es necesario.
Preguntas frecuentes
No. La extracción de texto con pdf.js y la generación del documento .docx con la librería docx ocurren completamente en tu navegador. El archivo nunca se envía a ningún servidor externo.
No. Extrae únicamente el texto de cada página; el diseño visual, las imágenes, las tablas, las columnas y las fuentes del PDF original no se reproducen en el documento Word. El resultado es un documento con un párrafo por línea de texto detectada y un salto de página por cada página del PDF, pensado para reutilizar el contenido, no para recrear el documento visualmente. Si necesitas conservar el diseño exacto, tendrás que recrearlo manualmente en Word a partir del texto extraído.
No. Esta herramienta solo puede extraer texto de PDFs que ya contienen una capa de texto real (no una imagen del texto). Si tu PDF es un escaneo sin capa de texto, el documento Word resultante estará vacío o casi vacío, ya que esta herramienta no realiza OCR (reconocimiento óptico de caracteres).
pdf.js reporta cuándo termina una línea de texto dentro de cada página del PDF original, y esa información se usa para separar el contenido en párrafos independientes. Es una reconstrucción razonable del texto, no una copia exacta del flujo de lectura del documento original, así que en documentos con diseño complejo (columnas, tablas) el orden de las líneas puede no coincidir exactamente con el que verías al leer el PDF.
Sí. El archivo descargado es un .docx estándar, totalmente compatible con Microsoft Word, LibreOffice Writer y Google Docs, y puedes editarlo con normalidad una vez abierto.
Alternativas
Adobe Acrobat y Microsoft Word (Abrir → seleccionar el PDF) también pueden convertir PDF a Word, generalmente con mejor conservación del diseño. Esta herramienta es útil cuando solo necesitas recuperar el texto rápido, sin instalar Acrobat ni tener Word abierto, y sin subir el documento a ningún servidor.