OCR de PDF

Reconoce el texto de un PDF escaneado y recupera un archivo que puedes buscar y copiar.

El reconocimiento corre en tu dispositivo, así que los registros y archivos escaneados se quedan contigo. Solo se descargan los datos de idioma, una vez, y el navegador los cachea.

Convierte el resultado buscable a Word

Acerca de OCR de PDF

Un PDF escaneado es una fotografía de un documento. Tú puedes leerlo, pero nada más: la búsqueda no encuentra nada, copiar no da nada y cualquier herramienta que trabaje con texto se queda sin materia prima. El reconocimiento de texto lo arregla leyendo las formas de las letras y escribiendo lo que encuentra dentro del archivo como una capa invisible situada exactamente sobre las palabras impresas. La página sigue viéndose idéntica —el escaneo no se toca—, pero el documento ya se puede buscar, seleccionar y convertir. El reconocimiento corre en tu navegador, en cualquiera de doce idiomas.

Características

Cómo usar OCR de PDF

  1. Suelta el PDF escaneado en la página
  2. Elige el idioma impreso en la página y una calidad de escaneo
  3. Inicia el reconocimiento y observa cómo avanza por las páginas
  4. Descarga el PDF buscable, o solo el texto reconocido

Ejemplo

Entrada

1987-minutes.pdf — 8 scanned pages, typewritten English

Salida

1987-minutes-searchable.pdf — same images, now with selectable text behind them.

La página visible no cambia; lo que cambia es que las palabras ya están dentro del archivo.

Errores comunes y solución de problemas

Preguntas frecuentes

¿El texto reconocido sustituye al escaneo?
No. La imagen queda exactamente como estaba y el texto se añade detrás, invisible. Eso es lo que hace que un PDF buscable se vea idéntico al original.
¿Se suben mis páginas escaneadas para reconocerlas?
No. El motor de reconocimiento corre en tu navegador. Lo único que se descarga son los datos de idioma, una vez, y el navegador los guarda en caché.
¿Cuántas páginas puedo reconocer de una vez?
Hasta treinta por ejecución, porque el reconocimiento es lo bastante lento como para que convenga tratar los documentos largos por tandas.
¿Qué calidad debo elegir?
Empieza por la rápida. Pasa a la superior cuando la letra sea pequeña, el escaneo sea antiguo o el primer intento salga desordenado.
¿Puedo pasar OCR a un PDF que ya tiene texto?
Puedes, pero no tiene sentido: compruébalo antes intentando seleccionar una palabra. Si ya hay texto, conviértelo directamente.

Herramientas relacionadas

Todas las herramientas de ArrayKit