Herramienta de PDF

OCR PDF e imagen a texto

OCR PDF: convierta un PDF escaneado o una imagen a texto en español, inglés, francés, alemán, árabe o urdu, o cree un PDF buscable.

Vista previa de la página

No hay ningún PDF cargado

Elija un PDF para ver la vista previa de sus páginas.

Su archivo nunca sale de su dispositivo.

Paso a paso

Cómo funciona

  1. 01

    Elija un PDF escaneado o una imagen JPG, PNG o WebP y marque el idioma o idiomas del documento.

  2. 02

    Elija texto sin formato o PDF buscable y ejecute el OCR; las páginas se procesan de una en una.

  3. 03

    Copie o descargue el texto reconocido, o descargue el PDF buscable.

Conviene saber

Preguntas frecuentes

¿Qué idiomas hay disponibles?

Inglés, francés, español, alemán, árabe y urdu, solos o combinados (por ejemplo, árabe e inglés). Los datos de cada idioma se descargan una sola vez, en el primer uso: unos 2,95 MB para inglés, 0,71 MB para francés, 2,10 MB para español, 1,33 MB para alemán, 1,66 MB para árabe y 1,02 MB para urdu, más unos 1,5 MB del motor.

¿El OCR sube mi documento?

No. Su documento se procesa en su navegador. El motor OCR y los datos de idioma elegidos se descargan desde este sitio web, y su documento nunca forma parte de esas solicitudes.

¿Qué es un PDF buscable?

Conserva la imagen de la página y añade una capa de texto invisible reconocida por OCR, para poder seleccionar y buscar el texto. El reconocimiento puede contener errores.

¿Por qué aparece un aviso en móviles y tabletas?

El motor y los datos de idioma elegidos requieren una descarga única de unos 2 a 5 MB, y el reconocimiento también consume memoria y batería. Se recomienda una conexión estable y un dispositivo con memoria disponible.

¿El OCR reconoce la escritura a mano?

Los modelos elegidos están pensados para texto impreso. La escritura a mano, el bajo contraste, la inclinación y las fuentes poco habituales reducen la precisión.

¿Qué precisión tiene el OCR en árabe y urdu?

Depende mucho del escaneo. Un texto naskh impreso, limpio, recto y en alta resolución da buenos resultados; el nastaliq, que usa la mayoría del urdu impreso, el texto pequeño y los escaneos torcidos o de baja resolución producen más errores. Revise siempre el resultado antes de confiar en él.