Saltar al contenido

Convertir PDF a Word

Convierte cualquier PDF en un documento de Word editable, con imágenes incluidas, un modo “Aspecto exacto” que reproduce las páginas originales y OCR integrado para escaneos. No se guarda nada; nunca conservamos tu archivo.

  • Nunca se guarda
  • Sin filas ni esperas
  • Sin registro, sin marca de agua

Cómo funciona

1

Agrega tu PDF

Suelta un PDF en la página. La herramienta lo revisa automáticamente y activa el OCR si detecta un escaneo.

2

Elige el modo

“Texto editable”, la opción predeterminada, te da un documento de Word normal, página por página con el PDF: párrafos, títulos, negritas y cursivas, enlaces e imágenes, cada página en su tamaño original con sus propios márgenes e interlineado, de modo que la página 12 del PDF es la página 12 del documento, en un archivo de un tamaño similar al del PDF. “Aspecto exacto” fija cada línea donde estaba, sobre una imagen de la página: reproduce el PDF para imprimir, pero es difícil de editar y pesa varias veces más. Con los escaneos, el OCR se activa solo, detecta el idioma a partir de la primera página y endereza las páginas escaneadas torcidas.

3

Convierte y descarga

Haz clic en “Convertir a Word” y descarga un .docx limpio, con títulos y párrafos, listo para editar.

Qué se convierte bien y qué no

Un PDF registra glifos en coordenadas. No tiene párrafos y, salvo que alguien lo haya etiquetado a propósito, tampoco títulos, así que ambos se deducen en lugar de leerse. Las palabras que comparten línea base forman una línea, un espacio vertical más amplio inicia un párrafo nuevo, y una línea corta compuesta a unas 1.6 veces el tamaño mediano del cuerpo del documento se convierte en un Título 1, y a 1.3 veces, en un Título 2. Conviene conocer esta última regla antes de empezar a editar: un documento cuyos títulos están en negrita pero no son más grandes que el texto del cuerpo llega como texto normal, y el panel de navegación de Word estará vacío.

Los enlaces se conservan, y eso sorprende. Una anotación de enlace sobre un fragmento de texto se convierte en un hipervínculo real de Word, y una entrada del índice o una referencia cruzada que saltaba a la página doce se convierte en un enlace interno a un marcador colocado al principio de esa página, así que el índice sigue funcionando después de la conversión.

Hay dos cosas que no se leen en absoluto. Las respuestas de un formulario PDF completado viven en objetos de campo y no en la página, así que en “Texto editable” simplemente no aparecen; “Aspecto exacto” las muestra, porque forman parte de la imagen de la página, pero no como texto editable. Los comentarios y los sellos son el mismo tipo de objeto y corren la misma suerte. Y en “Aspecto exacto” el diseño se renderiza una sola vez a 144 DPI con el texto real colocado encima, así que un logo o un gráfico que era vectorial en el PDF es una imagen en el .docx, y al ampliarlo se nota.

Si buscas otra cosa

Cuando lo que quieres son las palabras y no un documento de Word, pdftotext -layout file.pdf de Poppler es más rápido y predecible, mantiene las columnas separadas con espacios y es la forma habitual de pasar un PDF a cualquier otra cosa. Y si el PDF se creó a partir de un archivo de Word, pídele el .docx a quien lo hizo: toda conversión de vuelta es una reconstrucción a partir de coordenadas, y el original es la única copia que no lo es.

Las tablas son el punto débil de todos los conversores de PDF a cualquier formato, incluido este. Si un documento es sobre todo tablas y los números importan, Tabula y Camelot son gratuitos, están hechos para ese único problema y ganarán en eso a un conversor general.

Preguntas frecuentes

¿Se guarda mi PDF cuando lo convierto?

No. Ninguno de los dos modos de conversión guarda nada: nunca conservamos tu archivo. Con OCR, el lector y el paquete de idioma se descargan de este sitio la primera vez; tu documento en sí nunca se envía a ningún lugar.

¿Puede convertir PDF escaneados y fotos de documentos?

Sí. Activa el OCR (la herramienta lo sugiere automáticamente cuando detecta un escaneo) y el texto se lee de las imágenes de las páginas. El idioma se detecta a partir de la página (hay más de 120 disponibles, entre ellos español, inglés, bengalí, hindi, urdu, árabe y chino) y puedes elegirlo tú si la detección se equivoca. Los formularios con líneas se convierten en tablas reales de Word en el modo “Texto editable”.

¿Qué tan preciso es el OCR?

En escaneos limpios de texto impreso, la precisión es muy alta. La calidad baja con fotos borrosas, letra manuscrita o fuentes poco comunes. Los escaneos nítidos, rectos y bien iluminados dan los mejores resultados.

¿Se conservan el formato y las imágenes?

Sí. “Aspecto exacto” mantiene cada página en su tamaño original y la reconstruye en dos capas: cada foto, logo, franja de color y gráfico vectorial se reproduce exactamente como lo dibuja el PDF, y el texto real va encima en su posición original, con los colores, las negritas y los títulos originales. “Texto editable”, en cambio, reconstruye párrafos y títulos limpios con las imágenes en orden de lectura, página por página con el PDF: es la mejor opción si quieres editar mucho.

¿Qué formato de Word obtengo?

Un archivo .docx estándar que se abre en Microsoft Word, Google Docs, LibreOffice y cualquier editor moderno.

¿Hay un límite de páginas o de archivos?

No hay un límite fijo. El OCR tarda unos segundos por página, ya que la lectura la hace tu propio dispositivo, así que los escaneos muy largos simplemente tardan más; un indicador de progreso muestra exactamente por dónde va.

Conviene saber: Las fuentes se sustituyen por equivalentes cercanas, porque los PDF incrustan sus propias fuentes y Word no puede usarlas; por eso “Aspecto exacto” es casi idéntico, no idéntico al píxel, y una línea puede quedar un poco más ancha o más estrecha que la original. En los PDF con texto, las tablas se convierten en texto posicionado y no en tablas de Word; en los escaneos, las tablas con líneas se convierten en tablas de Word, pero las que no tienen líneas quedan como texto posicionado. El OCR ignora a propósito las fotos, los logos y los gráficos decorativos para que nunca se conviertan en caracteres basura, deja la letra manuscrita y los sellos como imágenes, y tarda unos segundos por página.

Agrega esta herramienta a tu sitio web

Gratis para cualquier blog, página de clase o artículo de ayuda. Pega un fragmento de código y tus visitantes podrán usarla directamente en tu página.