OCR a PDF buscable en tu ordenador

Tus escaneos se vuelven buscables y seleccionables. El OCR corre íntegramente en tu navegador: el documento nunca se sube a un servidor. Gratis incluye un PDF al día; el Pase 7 días y Pro no tienen límite.

100% privado: todo se procesa en tu ordenador, tus archivos nunca salen de tu dispositivo.

  1. Sube tu PDF escaneado: se abre localmente en tu ordenador
  2. El texto se reconoce localmente (español e inglés); las páginas con texto se conservan
  3. Descarga un PDF idéntico con capa de texto buscable

Qué hace OCR buscable

OCR buscable toma un PDF escaneado, reconoce el texto de cada página escaneada y lo escribe de vuelta en el PDF como una capa invisible colocada justo encima de las palabras impresas. La página se ve igual que antes, pero ahora puedes buscar en ella, seleccionar y copiar su texto, y cualquier indexador o gestor documental puede leerla. El reconocimiento se hace en tu navegador: el escaneo no se sube nunca.

La herramienta reconoce español e inglés, cargados a la vez, lo que cubre facturas, contratos, cartas oficiales, tiques e informes antiguos en cualquiera de los dos idiomas o mezclados. Es el paso que convierte una carpeta de escaneos en documentos en los que de verdad se puede encontrar algo, y la preparación natural antes de resumir, extraer texto o anonimizar un archivo escaneado.

Cómo hacer buscable un PDF escaneado

  1. Añade tu PDF. La pantalla previa muestra el nombre del archivo y el número de páginas y te recuerda lo que va a pasar: se reconoce español e inglés, las páginas que ya tienen texto se conservan intactas y todo ocurre en tu ordenador.
  2. Pulsa Reconocer texto. La primera vez, el navegador descarga el motor de reconocimiento y los dos paquetes de idioma, unos 8 MB en total, desde el propio dominio de OléPDF; después quedan en caché.
  3. Espera unos segundos por página escaneada. Cada página se dibuja a 350 puntos por pulgada en un ordenador, o a 200 en un móvil, se normaliza su contraste, se detectan y enderezan las páginas giradas y se descartan las palabras de baja confianza.
  4. Descarga el resultado, con el sufijo _ocr. Ábrelo en cualquier lector y prueba el cuadro de búsqueda.
  5. Con el Pase de 7 días o Pro puedes añadir varios PDF y pulsar Aplicar OCR a N PDFs para recibir un ZIP con un archivo buscable por cada escaneo.

Límites y comportamiento que conviene conocer

Solo se procesan las páginas que no tienen texto aprovechable. Una página se considera escaneada cuando contiene menos de diez caracteres de texto real; las que ya tienen capa de texto se copian sin cambios, así que pasar la herramienta por un documento mixto no tiene riesgo.

Privacidad: el reconocimiento ocurre en tu dispositivo

El motor de reconocimiento es una compilación WebAssembly que distribuye OléPDF, y los paquetes de idioma se sirven desde el mismo dominio. Las imágenes de página se dibujan en tu navegador, se pasan al motor en memoria y se descartan al terminar. El documento no se sube nunca, no se envía texto a ningún sitio y no interviene ningún script de terceros. Hasta el cupo diario del plan gratuito se cuenta en local, en tu navegador.

Eso hace que la herramienta sea adecuada para escaneos que sería un problema subir: documentos de identidad, historiales médicos, nóminas, escritos judiciales.

Para qué se usa

Preguntas frecuentes

¿El OCR es gratis en OléPDF?

El plan gratuito incluye un documento con OCR al día, contado por herramienta. El Pase de 7 días, de pago único, y el plan Pro dan OCR sin límite y permiten lotes de varios PDF.

¿Mi escaneo se sube para reconocerlo?

No. El motor y los datos de idioma se descargan una vez desde el propio dominio de OléPDF y se ejecutan en tu navegador. El PDF y su texto no salen de tu ordenador.

¿Qué idiomas reconoce?

Español e inglés, siempre los dos a la vez. No hay selector de idioma ni compatibilidad con otros alfabetos.

¿El PDF se ve distinto después?

No. La imagen escaneada se conserva tal cual. El único cambio es una capa de texto invisible alineada con las palabras impresas, que es lo que hace que funcionen la búsqueda y la selección.

¿Y si algunas páginas ya tienen texto?

Se dejan exactamente como estaban. Solo las páginas con menos de diez caracteres de texto real se tratan como escaneos y se reconocen.

¿Cuánto tarda?

Unos segundos por página escaneada en un ordenador actual, algo más en un móvil, donde el reconocimiento va a menor resolución para ahorrar memoria. La primera vez se suma la descarga única del motor.

Conversor PDF

Todas las herramientas

¿Fotos en vez de PDF? Prueba OléPIC, nuestras herramientas de imagen.