PDF a Word

Un PDF no contiene párrafos. Contiene caracteres, cada uno con su posición en la página: los párrafos, los títulos y el orden de lectura se tiraron cuando se escribió el archivo. Esta página vuelve a leer esas posiciones y reconstruye la estructura: los caracteres que comparten línea base forman una línea, las líneas que quedan cerca unas de otras forman un párrafo, y el texto claramente más grande pasa a ser un título. Eso funciona bien con un documento normal a una columna y mal con cualquier cosa maquetada como una cuadrícula. Después de cada ejecución te dice cuál de las dos tenías.

  • Sin subir nada
  • Sin cuenta
  • Sin marca de agua
  • Sin límite de archivos
Arrastra aquí tus archivoso haz clic para elegirlosSin límite de tamaño ni de cantidad: solo lo que tu propio equipo pueda manejar.

Tus archivos

Funciona mejor con documentos normales a una columna. Las tablas, las páginas a varias columnas y todo lo que esté dibujado como diagrama no salen intactos; las notas de después de la ejecución dicen qué pasó con el tuyo.

Al OCR solo van las páginas que no tienen nada de texto. La primera vez descarga un motor de reconocimiento (unos 15 MB), tarda varios segundos por página y devuelve texto plano: sin títulos y sin negrita.

Desactivado por defecto, de modo que un párrafo partido entre dos páginas del PDF se vuelve a unir. Actívalo si el archivo de Word tiene que paginar como el PDF.

    Todavía no has elegido nada.

    A dónde va tu archivo

    A ninguna parte. Esta página descarga un pequeño programa en tu navegador, y ese programa lee el archivo directamente de tu disco. El programa viene de este sitio, igual que una imagen o una hoja de estilos, pero tu archivo solo viaja de tu disco a tu propia pestaña.

    Por qué esta herramienta

    Lo que los grandes conversores no pueden ofrecerte.

    Párrafos, no una línea por párrafo

    El convertidor gratuito de siempre te da un párrafo de Word por cada línea impresa, así que cada frase queda cortada justo donde el PDF hizo el salto de línea y no puedes recomponer nada. Este vuelve a unir las líneas —incluidas las palabras partidas con guion al final de la línea— y solo abre un párrafo nuevo donde el interlineado, la sangría, el cuerpo de letra o la negrita cambian de verdad.

    Los títulos pasan a ser títulos de Word

    El texto más grande que el cuerpo se ordena por tamaño y se asigna a Título 1, 2 y 3, así que el panel de navegación se rellena y Referencias → Tabla de contenido funciona. La negrita y la cursiva salen de la fuente con la que se dibujó cada tramo de caracteres, no de adivinar por la forma de las letras.

    Los encabezados repetidos y los números de página se quitan

    La misma línea en lo alto de cuarenta páginas no son cuarenta párrafos de contenido. Las líneas que caen en el margen superior o inferior y se repiten en más de la mitad del documento, y los números de página sueltos, se eliminan; y se te dice cuántas se quitaron, para que puedas juzgar si se llevó algo que no debía.

    Dice dónde falló

    Las páginas a varias columnas, las filas que parecen de una tabla, las imágenes que no pudo recortar, el texto girado y las páginas sin nada de texto se cuentan y se explican una por una debajo del botón de descarga. Decides tú si el resultado es lo bastante bueno antes de mandárselo a nadie.

    Cómo se usa

    Elige uno o varios PDF. Si alguno es un escaneo, marca la casilla de OCR antes de empezar.

    Arranca la conversión. Cada página se lee dos veces —una para el texto y otra para deducir la maquetación—, así que un documento largo tarda.

    Descarga el .docx y lee después las notas que hay debajo del botón: ahí dice qué no sobrevivió.

    Cuándo viene bien

    Necesitas editar dos párrafos del PDF de otra persona

    Reaprovechar las condiciones de un proveedor, una cláusula de un contrato, un apartado de un informe. Quieres texto que puedas cambiar, no una foto de una página.

    Sacar el texto sin volver a teclearlo

    Una propuesta, un artículo o un manual que solo existe en PDF, y el cuerpo del texto tiene que acabar en algún sitio donde puedas trabajarlo.

    El archivo no puede ir al servidor de un desconocido

    Contratos, informes médicos, documentos personales, cualquier cosa bajo un acuerdo de confidencialidad. Todos los demás convertidores quieren el archivo subido antes de mover un dedo.

    Preguntas

    ¿El archivo de Word se verá igual que el PDF?

    No, y tampoco lo pretende. Esto no copia maquetación. Coloca el texto en orden de lectura con los estilos propios de Word, en una página del mismo tamaño que el original y con los márgenes tomados de donde está el texto en realidad. Los saltos de línea, las fuentes exactas, el espaciado entre letras, las columnas y todo lo que esté dibujado como gráfico vectorial no se reproducen. Si necesitas algo idéntico, lo que necesitas es el PDF.

    ¿Qué pasa con las tablas?

    No salen como tablas de Word. Un PDF no registra una tabla: solo celdas de texto que resulta que quedan alineadas. Cuando una línea tiene huecos anchos dentro, esos huecos se convierten en tabulaciones y la línea forma su propio párrafo, así que los datos están todos y en el orden correcto. Para recuperar una tabla de verdad, selecciona esas líneas en Word y usa Insertar → Tabla → Convertir texto en tabla, con Tabulaciones como separador. El informe dice cuántas líneas salieron así.

    ¿Y las páginas a dos columnas?

    Se detectan buscando una franja vertical que recorra la página sin que ninguna línea la cruce, y entonces cada columna se lee de arriba abajo por turnos, que es el orden de lectura correcto, y se te dice para que lo compruebes. Con tres columnas funciona igual. Lo que lo rompe es una página donde las columnas empiezan y terminan a media altura, o una barra lateral que se solapa con el texto principal: eso sale entremezclado y se nota enseguida.

    Mi PDF es un escaneo y el archivo de Word sale vacío.

    Una página escaneada es la fotografía de un papel. No hay caracteres dentro que leer, así que no hay nada que convertir. Marca «Leer las páginas escaneadas con OCR» y esas páginas se reconocen en lugar de leerse, pero el OCR de aquí solo sabe inglés, tarda varios segundos por página y devuelve texto plano, sin títulos y sin negrita. Si tu escaneo no está en inglés, esta herramienta no te sirve, y no hay ajuste que lo cambie.

    ¿La negrita y la cursiva son fiables?

    Salen de la fuente con la que se dibujó cada tramo de caracteres, así que aciertan siempre que el documento usara una negrita o una cursiva de verdad, que es lo más frecuente. Fallan cuando un PDF finge la negrita dibujando cada contorno dos veces, y pueden fallar con una fuente normal inclinada. El subrayado, el color del texto y el resaltado no se conservan en absoluto.

    ¿Puedo convertir varios archivos a la vez?

    Sí. Cada PDF sale en su propio .docx. A partir de tres archivos llegan en un único zip, porque los navegadores bloquean varias descargas seguidas y perderías algunas sin enterarte. Un PDF de más de 2 GB no se puede ni abrir: un navegador no puede leer de una vez un archivo tan grande, y ese es el límite del navegador, no nuestro.

    ¿Se sube mi archivo?

    No. Esta página lee el PDF desde tu disco, el archivo de Word se monta en la pestaña y la descarga sale de tu propio navegador. Puedes tener abierto el panel de red mientras se ejecuta. El lector de PDF y el motor de OCR se descargan de este sitio la primera vez, igual que cualquier script; tu documento no forma parte de eso.

    Otras herramientas