PDF a Word: qué se conserva en la conversión y qué no
Todos los conversores prometen una copia perfecta. Ninguno puede dártela, y conviene saber por qué antes de juzgar el resultado: los dos formatos parten de ideas opuestas.
Dos ideas opuestas
Un documento de Word es un flujo: párrafos uno detrás de otro, y Word decide dónde termina la página cuando lo abres. Un PDF es lo contrario: guarda en qué punto exacto de la hoja se imprimió cada fragmento de texto, en coordenadas, precisamente para que se vea igual en todas partes.
Convertir de PDF a Word consiste en leer esas coordenadas y deducir el flujo hacia atrás: qué fragmentos forman un renglón, qué renglones forman un párrafo, cuál es un título, dónde empieza una tabla. Un buen conversor deduce bien; ninguno lo sabe con certeza, porque esa información se tiró a propósito al crear el PDF.
Lo que vuelve bien
El texto, con su tamaño, sus negritas y cursivas, sus subrayados y sus colores. Los títulos vuelven como títulos, así que el panel de navegación de Word funciona y puedes regenerar un índice.
Las tablas dibujadas con líneas vuelven como tablas reales de Word, celda a celda, que es lo que te permite ordenarlas o añadir una columna. Las tablas sin bordes se deducen por cómo se alinean las columnas, y las herramientas honestas marcan eso como una deducción.
Las imágenes, el tamaño de página y los márgenes. Las listas conservan su viñeta o su numeración. Los encabezados y pies que se repiten se detectan y se escriben como encabezado y pie, no como texto pegado arriba en cada página.
Lo que no vuelve, y por qué
Los cortes de línea exactos, cuando el original usaba una fuente que tu equipo no tiene. Word la sustituye, la sustituta es un pelo más ancha o más estrecha, y la última palabra del renglón se mueve. Eso no lo evita nada salvo instalar la fuente original.
Los cuadros de texto, WordArt, las notas al pie, los gráficos y los dibujos hechos con formas: un PDF no los guarda como objetos, solo como instrucciones de dibujo. Lo que recuperas es su aspecto, no un gráfico editable.
Un PDF escaneado no tiene texto en absoluto. Sus páginas son fotografías, así que no hay nada que pasar a Word hasta que alguien lea las palabras dentro de la imagen.
Leer una imagen exige OCR, que CLEKARA todavía no hace: detecta ese caso y se detiene con una explicación en lugar de entregarte un documento vacío.
Cómo sacar un resultado mejor
Parte del PDF original, no de una fotocopia de una impresión. Cada generación de más emborrona las letras y empeora la deducción.
Si el documento va a dos columnas, comprueba antes el orden de lectura. Las columnas son donde más se equivocan los conversores, y es mucho más rápido notarlo en la primera página que después de editar veinte.
Convierte y luego arregla en Word, no al revés. Regenera el índice, repasa las tablas y guarda como .docx. Diez minutos de repaso sobre una buena conversión ganan a una hora de volver a teclear.
Puedes probarlo con tu propio archivo en PDF a Word; el archivo se lee en tu navegador y no se sube a ningún sitio.