ToolGenie
PDFPublicado 4 min de lectura

Cómo editar un PDF escaneado

Abres un PDF, intentas cambiar una fecha y no pasa nada. El cursor no selecciona nada. La herramienta de texto no encuentra texto. Parece un documento y se comporta como una imagen.

Es porque es una imagen. Si el archivo viene de un escáner, una fotocopiadora o la cámara de un móvil, cada página es una fotografía de una página, y en el archivo no hay texto que editar. Todo lo que se siente roto al editarlo se deriva de ese único hecho.

Confírmalo en dos segundos

Abre el PDF e intenta seleccionar una frase arrastrando. Si el texto se marca, tienes un PDF de texto real y un problema distinto. Si no se marca nada —o se marca la página entera como un solo bloque— es un escaneo.

Una segunda comprobación: usa la búsqueda del lector con una palabra que veas claramente en la página. Si no encuentra nada, es que no hay nada que encontrar.

Opción uno: superponer (lo más rápido, funciona siempre)

No intentes cambiar lo que hay en la página: pon algo nuevo encima. Tapa la cifra equivocada con un recuadro blanco y escribe la correcta encima. Añade tu firma. Rellena las líneas en blanco. Marca las casillas.

Esto funciona en cualquier PDF, escaneado o no, no necesita conversión y no puede estropear la maquetación porque no la toca. Para la inmensa mayoría de ediciones — rellenar un formulario, corregir una fecha, firmar — no es un apaño: es la respuesta correcta.

  • Ajusta el recuadro blanco al fondo de la página: un escaneo rara vez es blanco puro, así que toma el color en lugar de suponerlo.
  • Iguala el tamaño de letra al texto de alrededor y elige una tipografía parecida.
  • Ponlo al 100% de zoom para comprobar la alineación. Una corrección un milímetro fuera de la línea base canta en papel.

Opción dos: OCR y después editar de verdad

El OCR lee los píxeles, reconoce los caracteres y añade una capa de texto real al documento. La página queda idéntica después; lo que cambia es que el archivo ya contiene texto: buscable, copiable y legible por un lector de pantalla.

Es lo que quieres cuando el documento va a un archivo, cuando necesitas citarlo o cuando vas a tener que encontrarlo de nuevo por su contenido. Es además el paso previo necesario si piensas convertirlo a Word.

Opción tres: convertir a Word y reescribir

Si necesitas reescribir párrafos enteros en lugar de parchear una línea, pasa el OCR y después convierte a Word. Obtienes un documento editable con texto real que puedes reestructurar libremente.

Cuenta con hacer algo de limpieza. El OCR acierta un 98-99% en un escaneo limpio a 300 ppp y menos en cualquier cosa peor, y la conversión tiene que reconstruir la maquetación por inferencia. Revisa los números con especial dureza: un dígito mal leído en un importe o un número de cuenta es el error que cuesta dinero, y ningún corrector lo señalará porque sigue siendo un número válido.

Conseguir un escaneo mejor desde el principio

Todo lo que viene después es más fácil si el escaneo es bueno, y casi todos los escaneos malos vienen de fotografiar mal una hoja, no de un equipo malo.

  • 300 ppp. Por debajo de 200 ppp la precisión del OCR cae en picado.
  • Recto. Una página escaneada con algo de inclinación pierde precisión línea a línea.
  • Luz uniforme. Fotografía con luz de día lateral, nunca bajo una lámpara que proyecte tu propia sombra.
  • Desde justo encima. Disparar en ángulo produce una distorsión de perspectiva que el OCR lleva mal.
  • Usa el modo escáner de documentos del móvil si lo tiene: corrige la perspectiva y aplana la iluminación automáticamente.

Una cosa que conviene vigilar

Si estás tapando algo en lugar de corregirlo — ocultar un número de cuenta antes de mandar un extracto, por ejemplo — un recuadro blanco o negro no basta en un PDF *de texto*, porque el texto de debajo sobrevive. En un escaneo no hay texto debajo, así que el recuadro sí lo oculta de verdad.

El matiz está en saber cuál tienes. Si pasaste el OCR primero, tu escaneo ya contiene texto, y un recuadro dibujado deja de ocultar nada. Tacha correctamente, o tapa antes de pasar el OCR.

Preguntas frecuentes

¿Por qué no puedo seleccionar el texto de mi PDF?

Porque no hay texto dentro. Las páginas son imágenes de un escáner o una cámara. Pasa el OCR para añadir una capa de texto, o superpón tus cambios encima, que funciona en ambos casos.

¿El OCR es lo bastante fiable?

En un escaneo limpio y recto a 300 ppp de texto impreso, un 98-99%. Eso siguen siendo unos veinte errores en una página de 2.000 palabras, concentrados en 1/l/I y 0/O. Revisa siempre, y empieza por los números.

¿El OCR lee la escritura a mano?

No de forma fiable. El OCR está pensado para texto impreso, y reconocer escritura manual es un problema mucho más difícil con resultados bastante peores. Cuenta con transcribir tú las partes manuscritas.

Herramientas que aparecen en esta guía

Todo lo de abajo funciona en tu navegador. No se sube ningún archivo.

Seguir leyendo

Todas las guías