Documentos y PDF
Pasar el texto de un PDF a Word
Saca el texto de un PDF a un documento de Word que puedas editar, con los párrafos reconstruidos y las palabras partidas por guion vueltas a unir. Es el texto, no una copia visual del PDF: te explicamos abajo por qué eso no existe.
Léelo antes de convertir
Añade el PDF del que quieres sacar el texto.
Cómo sacar el texto de un PDF
Añade el PDF
Arrástralo o pulsa para elegirlo. Tiene que ser un PDF con texto, no un escaneo.
Pulsa extraer
Se recorre página por página agrupando las letras en líneas y las líneas en párrafos.
Abre el .docx
Un documento de Word editable con el texto listo para trabajar.
Por qué «PDF a Word» no significa lo que la gente espera
Casi todas las páginas que ofrecen esto prometen una conversión perfecta. Conviene explicar por qué eso no puede ser cierto, porque entenderlo te ahorra tiempo y decepciones.
Un archivo de Word guarda estructura: esto es un párrafo, esto es un título, esto es una lista. Un PDF no guarda nada de eso. Un PDF guarda letras colocadas en coordenadas, como si alguien hubiera pegado cada carácter en un punto exacto de la hoja. Dentro del archivo no existe el concepto de «párrafo», ni de «columna», ni siquiera de «palabra» en muchos casos.
Convertir un PDF a Word significa, entonces, adivinar la estructura a partir de las posiciones: si estas letras están a la misma altura serán una línea, si estas líneas están juntas serán un párrafo. Es un problema de interpretación, y por eso ningún programa —tampoco los de pago, tampoco los que cobran suscripción— lo resuelve del todo. Con una tabla, un pie de foto o un texto a dos columnas, todos se equivocan.
Qué hace esta herramienta exactamente
Lo que sí se puede hacer bien, y es lo que la mayoría necesita de verdad: recuperar el texto para poder editarlo.
Se recorre cada página, se agrupan las letras en líneas por su altura, se ordenan de izquierda a derecha y se detectan los espacios reales entre palabras. Después las líneas se agrupan en párrafos midiendo el hueco vertical: cuando la separación crece, empieza un párrafo nuevo. Y las palabras partidas por un guion al final de la línea se vuelven a unir, para que no acabes con «prorro-» y «gables» separados.
El resultado es un .docx que abre Word, LibreOffice o Google Docs, con el texto listo para reescribir, con las páginas separadas y sin nada que descargar ni instalar.
Los PDF escaneados no llevan texto
Este es el caso que más confusión genera. Si el PDF se hizo escaneando papel o fotografiando páginas, dentro no hay letras: hay una imagen de cada página. Se ve texto, pero para el ordenador es un dibujo.
Sacar texto de ahí requiere reconocimiento óptico de caracteres, que es otra tecnología distinta. Esta herramienta te avisará claramente en lugar de darte un documento vacío. Una pista para saberlo de antemano: abre el PDF e intenta seleccionar una frase con el ratón. Si no puedes, es un escaneo.
Si lo que necesitas es la maquetación
Cuando de verdad hace falta conservar el diseño —un contrato con su formato, un folleto, una factura con plantilla— la salida realista no es convertir. Es pedir el documento original a quien lo hizo. Casi siempre existe un .docx detrás de ese PDF, y recuperarlo cuesta un correo en lugar de una tarde peleándose con una conversión que nunca queda bien.
Y si solo necesitas cambiar un dato suelto o tachar algo, muchas veces es más rápido editar el propio PDF o recomponerlo por páginas que convertirlo entero.
El PDF no sale de tu ordenador
Los documentos que la gente convierte a Word suelen ser justo los que no debería subir a una web cualquiera: contratos, informes, expedientes, trabajos académicos. Aquí el archivo se abre y se procesa dentro de tu navegador; no hay servidor que lo reciba.
Preguntas frecuentes
¿Me devuelve el PDF con el mismo diseño en Word?
No, y ninguna herramienta lo hace de forma fiable. Un PDF guarda letras en coordenadas, no párrafos ni columnas: la estructura hay que adivinarla. Lo que obtienes aquí es el texto reconstruido en párrafos, editable, que es lo que la mayoría necesita.
¿Funciona con PDF escaneados?
No. Un PDF escaneado contiene una imagen de cada página, no letras. Haría falta reconocimiento óptico de caracteres, que es otra tecnología. Para saberlo de antemano: abre el PDF e intenta seleccionar una frase con el ratón; si no puedes, es un escaneo.
¿Qué hace exactamente con el texto?
Agrupa las letras en líneas por su altura, las ordena de izquierda a derecha, detecta los espacios reales entre palabras, junta las líneas en párrafos según el hueco vertical y vuelve a unir las palabras partidas por un guion al final de línea.
¿Se conservan las negritas, las tablas y las imágenes?
No. El resultado es texto plano organizado en párrafos y separado por páginas. Los estilos, las tablas y las imágenes no se trasladan: reconstruirlos exigiría el mismo análisis de maquetación que hace inviable la conversión fiel.
¿Se sube mi PDF a algún servidor?
No. El documento se abre y se procesa dentro de tu navegador. Ni el PDF ni el documento de Word resultante salen de tu dispositivo.
¿Qué hago si necesito el diseño original?
Pedir el documento original a quien hizo el PDF. Casi siempre existe un .docx detrás, y recuperarlo cuesta un correo en lugar de una tarde peleándose con una conversión que nunca queda bien.
Más herramientas de Formatly
Todas gratis y todas funcionando dentro de tu navegador.