OléPDFGuías › Anonimizar un PDF escaneado

Cómo anonimizar un PDF escaneado sin dejar texto OCR oculto

Publicado el 6 de agosto de 2026

Un PDF escaneado parece una colección de fotografías, pero puede contener dos versiones del mismo documento: la imagen que ves y una capa de texto OCR invisible que permite buscar y copiar. Tapar un nombre en la imagen no sirve si ese mismo nombre sigue vivo debajo.

Para anonimizarlo bien hay que detectar datos en la imagen, eliminar las zonas visibles y asegurarse de que la salida no conserve texto oculto. Ese flujo puede hacerse localmente, sin enviar el escaneado a un servicio externo.

Anonimizar un PDF escaneado 100% en tu navegador: el documento no se sube a ningún servidor.

Cómo saber si tu escaneado tiene una capa OCR

Abre el PDF e intenta seleccionar una frase con el cursor. También puedes buscar una palabra que se vea en la página. Si el visor la encuentra, existe una capa de texto. Si no la encuentra, puede ser una imagen pura, aunque eso no cambia la necesidad de revisar visualmente cada dato.

La capa OCR es útil para accesibilidad y búsqueda, pero durante la redacción se convierte en un segundo contenido que hay que eliminar. Una marca dibujada únicamente sobre la imagen no la modifica.

Proceso seguro paso a paso

  1. Abre la herramienta para anonimizar un PDF y carga el escaneado. El archivo no sale del dispositivo.
  2. El OCR local lee las páginas que lo necesitan. Su precisión depende de resolución, contraste, inclinación, idioma y calidad del original.
  3. Revisa las detecciones automáticas y añade manualmente cualquier dato ilegible, manuscrito o mal reconocido.
  4. Marca también elementos gráficos: firmas, caras, sellos, matrículas, QR o códigos de barras.
  5. Genera el resultado. Las páginas redactadas se aplanan y no conservan una capa OCR recuperable debajo de las marcas.
  6. Abre el archivo final y repite las pruebas de búsqueda, selección y copia sobre las zonas eliminadas.

Cómo mejorar la detección en escaneados difíciles

Escaneo anonimizado frente a PDF accesible

Aplanar la página elimina el texto oculto y reduce el riesgo de recuperación, pero también puede perder búsqueda y accesibilidad en las páginas afectadas. Es un compromiso deliberado para la copia redactada.

Conserva el original accesible bajo los controles que correspondan y distribuye la copia anonimizada solo para la finalidad prevista. No sobrescribas el único ejemplar.

Lista de comprobación

  1. Busca nombres, documentos de identidad, IBAN, correos y teléfonos en el resultado.
  2. Intenta seleccionar y copiar texto bajo cada marca.
  3. Amplía firmas, caras y códigos, porque no siempre son texto.
  4. Revisa metadatos y el nombre del archivo.
  5. Abre el PDF con un segundo visor si el documento es especialmente sensible.

Preguntas frecuentes

¿Qué es la capa OCR de un PDF?

Es texto invisible alineado con la imagen escaneada para permitir búsquedas, selección y copia. Puede seguir conteniendo un dato aunque visualmente se haya cubierto en la imagen.

¿OléPDF elimina el texto OCR bajo una redacción?

Sí. Las páginas con redacciones se aplanan en el resultado, por lo que no conservan texto seleccionable debajo de las marcas.

¿El OCR detecta todos los datos?

No. La precisión depende de la calidad, orientación, tipografía e idioma, y los manuscritos son especialmente difíciles. Revisa todas las páginas y añade manualmente lo que falte.

¿Puedo anonimizar una foto de un documento?

Sí. Puedes abrir JPG, PNG o WebP, usar el OCR y la detección local, añadir marcas y descargar una imagen redactada.

¿El escaneado se sube para hacer OCR?

No. El OCR y la detección se ejecutan en tu navegador. Puede descargarse el motor de OCR la primera vez, pero el documento no se envía a ningún servidor.

Elimina lo visible y lo invisible

Revisa la imagen, la capa OCR y los elementos gráficos en un solo flujo. El escaneado se procesa localmente y nunca se sube.

Revisar mi documento escaneado 100% en tu navegador: el documento no se sube a ningún servidor.