Sin subida, 100% local, sin cuenta

Tutorial

Cómo redactar un PDF para que el texto realmente desaparezca

Dibujar un rectángulo negro sobre un nombre o un número de cuenta en un editor de PDF muchas veces solo añade una forma encima de la página: el texto original sigue pudiendo seleccionarse, copiarse o encontrarse con otro lector una vez que esa forma se elimina o se ignora. Una redacción real significa que el texto sensible ya no forma parte del documento en absoluto. Esta guía convierte la página en una imagen y tapa la zona sensible directamente en los píxeles, y luego reconstruye un PDF a partir de las imágenes redactadas, encadenando tres herramientas que se ejecutan cada una en tu navegador.

Paso a paso

  1. Abre la herramienta PDF a imagen y convierte tu documento. Elige PNG en lugar de JPEG para que el recuadro negro salga con bordes limpios y sólidos en vez de artefactos de compresión, y elige 300 PPP para que las partes intactas de la página sigan siendo legibles. Cada página se descarga como un archivo de imagen independiente.
  2. Para cada página que contenga algo que ocultar, abre la imagen en la herramienta Redactar imagen, dibuja un rectángulo sobre el texto sensible y ajusta el modo a Recuadro negro. Descarga la imagen redactada. Repite para cada página que lo necesite; una página sin nada que redactar puede usarse tal como salió del paso 1.
  3. Suelta todas las imágenes de página, redactadas e intactas, en la herramienta Imágenes a PDF, en su orden original. La herramienta coloca una imagen por página y reconstruye un único PDF.
  4. Convierte y descarga el PDF reconstruido. Ábrelo e intenta seleccionar o buscar el texto que antes era visible en las páginas redactadas: no hay nada que seleccionar, porque la página ahora es una imagen, no texto.

Por qué un rectángulo negro en un editor de PDF a menudo no basta

Muchos editores de PDF te dejan dibujar una forma opaca sobre un párrafo y llamarlo redactado, pero esa forma suele ser un objeto separado que se coloca encima del contenido de la página, no un cambio en el texto en sí. Los caracteres originales pueden seguir ahí debajo: seleccionar la zona, ejecutar Seleccionar todo, abrir el archivo en otro visor o eliminar la anotación puede devolver el texto tapado. Como no hay una forma fiable de que un usuario habitual compruebe si un editor concreto realmente borra el texto subyacente o solo lo pinta encima, el enfoque más seguro es eliminar la capa de texto por completo antes de dibujar el recuadro negro.

Rasterizar elimina la capa de texto antes de redactar

Convertir una página de PDF a imagen con la herramienta PDF a imagen renderiza la página a través de PDF.js sobre un canvas y exporta los píxeles como un archivo PNG o JPEG. Una vez hecho esto, la página ya no tiene ningún objeto de texto: es una cuadrícula de colores de píxel. Dibujar un recuadro negro sobre esa imagen con la herramienta Redactar imagen en modo Recuadro negro sobrescribe los valores de píxel dentro del rectángulo con negro sólido, descartando lo que hubiera antes. No hay texto debajo que recuperar, porque ya no hay texto en ninguna parte del archivo.

Qué se pierde al reconstruir el PDF a partir de imágenes

Volver a montar las páginas con la herramienta Imágenes a PDF produce un documento hecho enteramente de imágenes. Ese es el objetivo para las páginas redactadas, pero se aplica a todas las páginas que incluyas: ningún texto del PDF final es seleccionable, buscable ni legible por un lector de pantalla, ni siquiera en las páginas que no tenían nada que ocultar. Espera también que el archivo sea notablemente más grande que el PDF original basado en texto, ya que las imágenes ocupan más espacio que el texto vectorial y las fuentes que sustituyen. Conserva el PDF original guardado en privado y comparte solo la copia rasterizada y redactada con quien la necesite.

Las herramientas usadas en esta guía

Preguntas frecuentes

¿Dibujar un recuadro negro directamente en un editor de PDF borra el texto que hay debajo?

Depende por completo del editor, y normalmente no hay una forma sencilla de comprobarlo. Algunas herramientas realmente eliminan el contenido tapado al aplanar o exportar el archivo; otras dejan el objeto de texto original en la página debajo de una forma opaca, recuperable por cualquiera que sepa buscarlo. Como no puedes saber fácilmente cuál de los dos casos se aplica a un PDF concreto, rasterizar la página primero y tapar los píxeles directamente elimina la ambigüedad: una vez que la capa de texto desaparece, no queda nada que recuperar.

¿El PDF redactado seguirá teniendo texto seleccionable o buscable en alguna parte?

No, en ninguna página, una vez que reconstruyes el documento a partir de imágenes. Rasterizar es una operación de todo o nada para las páginas que conviertes: las páginas que no necesitabas redactar también pierden su texto seleccionable. Esa contrapartida elimina toda duda sobre el contenido sensible; si solo algunas páginas necesitan este tratamiento, puedes fusionarlas después con páginas de texto intacto del documento original usando la herramienta Fusionar PDF, si te importa mantener algunas páginas buscables.