Cómo corregir texto copiado de un PDF (saltos de línea y espaciado)

26 de junio de 2026 · 5 min de lectura
Probar la herramientaEliminar saltos de línea →

Copias un par de párrafos de un PDF, los pegas en un documento y el texto es un desastre, cada línea termina abruptamente, las oraciones se cortan en fragmentos y hay líneas en blanco por todas partes. Este es uno de los problemas de texto más comunes y molestos, y ocurre por una razón específica. Una vez que comprendas por qué, solucionarlo lleva unos segundos.

¿Por qué el texto PDF se divide así?

Los archivos PDF almacenan texto por su posición visual en la página, no como un flujo fluido de oraciones. Cada línea que ve está ubicada en coordenadas específicas y el PDF realmente no "sabe" que una línea continúa con la siguiente como una oración. Entonces, cuando copia, la extracción inserta un salto de línea al final de cada línea visual, porque en lo que respecta al archivo, cada línea es un objeto colocado por separado. El resultado es un texto dividido en cada línea en lugar de en cada párrafo, a menudo con líneas en blanco adicionales entre ellas. No es culpa suya ni de la función de copia; así es como los PDF representan el texto.

¿Qué significa realmente "arreglar"?

Arreglar el texto copiado en PDF significa volver a unir las líneas discontinuas en los párrafos adecuados. Pero hay una sutileza: desea unir las líneas dentro de un párrafo manteniendo los saltos entre párrafos. Eliminar ingenuamente cada salto de línea fusionaría todo el documento en un bloque gigante sin ninguna estructura de párrafo, lo cual es peor. La buena solución distingue un salto de línea dentro de un párrafo (que debería convertirse en un espacio) de la línea en blanco entre párrafos (que debería permanecer). Eso es lo que convierte el texto roto en prosa legible.

Las herramientas para el trabajo.

Dos limpiezas relacionadas lo solucionan. Al eliminar los saltos de línea se vuelven a unir las líneas fragmentadas; el mejor modo es aquel que reemplaza los saltos de línea con espacios dentro de los párrafos y al mismo tiempo conserva las líneas en blanco que separan los párrafos, para obtener un texto fluido con su estructura intacta. Luego, al eliminar las líneas vacías, se borran las líneas en blanco sobrantes del PDF insertado. Ejecútelos en ese orden y el texto PDF desordenado se convertirá en párrafos limpios y legibles que realmente podrá utilizar.

La herramienta Eliminar saltos de línea de TextCaret tiene un modo de "conservar párrafos" que une líneas discontinuas dentro de cada párrafo conservando los saltos entre ellas, exactamente lo que necesita el texto copiado en PDF. Combínelo con Eliminar líneas vacías para una limpieza completa.

Otras fuentes con el mismo problema.

Los archivos PDF son los peores, pero el mismo problema de líneas discontinuas aparece en otros lugares. El texto copiado de los correos electrónicos, especialmente los reenviados, a menudo llega con saltos de línea de ancho fijo. Algunas páginas web y comentarios de código envuelven el texto con saltos de línea reales. El texto de documentos antiguos y la salida del terminal pueden hacer lo mismo. La solución es idéntica en todos los casos: volver a unir las líneas dentro de los párrafos, mantener los saltos de párrafo y borrar los espacios vacíos. Una vez que reconozcas el patrón, lo arreglarás reflexivamente.

Un flujo de trabajo de texto limpio

Para texto pegado completamente desordenado, una limpieza de tres pasos maneja casi cualquier cosa: elimine los saltos de línea adicionales para volver a unir párrafos, elimine las líneas vacías para limpiar los espacios y elimine los espacios adicionales para normalizar cualquier espacio en blanco duplicado o extraviado que haya dejado la fuente. Debido a que todas estas herramientas se ejecutan en el navegador, puede limpiar un documento confidencial sin que se cargue nada. El resultado es un texto que se ve y se comporta como si hubiera sido escrito limpiamente.

Probar la herramientaEliminar saltos de línea →