Saltar al contenido

PDF escaneado a texto

En un escaneo, cada página es una imagen del papel: no hay texto que copiar. El reconocimiento de texto (OCR) lee las letras en tu dispositivo y te da el texto en un archivo .txt, además de un PDF en el que ya puedes buscarlo.

Procesado en tu dispositivoNada se envía a servidores

Arrastra uno o más PDF aquí

Archivos PDF

Los archivos se abren en tu dispositivo y nunca se envían.

Cómo funciona

  1. Elige el escaneo

    Arrastra el PDF escaneado (o una foto de un documento guardada en PDF) al área de trabajo, o usa el botón.

  2. Confirma el idioma

    El idioma de la página ya viene elegido; marca los demás que tenga el documento. La primera vez, MovaDoc descarga los datos del reconocimiento: unos 3 MB por idioma.

  3. Descarga el texto

    Verás el principio del texto reconocido en la pantalla. Pulsa «Descargar el texto (.txt)» para tener todo el texto, o descarga el PDF en el que se puede buscar.

Preguntas frecuentes

¿Por qué no puedo copiar el texto de mi PDF?

Porque es un escaneo: cada página es una imagen del papel, sin letras guardadas, y el lector de PDF solo ve una foto. El OCR reconoce las letras de esa imagen y las convierte en texto que puedes copiar, editar y buscar.

¿El texto sale con el formato del documento?

No. El archivo .txt tiene solo el texto, línea a línea, con una línea en blanco entre párrafos: sin tipos de letra, negrita, imágenes ni la cuadrícula de las tablas. Para un documento de Word que se edita con títulos, listas y tablas, usa «PDF a Word», que también reconoce las páginas escaneadas.

¿Funciona con fotos de documentos y con escritura a mano?

Con fotos guardadas en PDF, sí, si están nítidas y rectas: cuanto mejor sea la imagen, menos errores. Si la foto está en JPG o PNG, ponla primero en un PDF con «Imágenes a PDF». La escritura a mano no se reconoce: los datos del reconocimiento solo sirven para texto impreso.

¿Puedo sacar el texto de varios PDF a la vez?

Sí, en dos pasos. Con varios PDF, recibes un ZIP con los PDF en los que ya se puede buscar (sin los archivos .txt). Después, «Continuar con…» → «PDF a texto», que también trata varios archivos a la vez, te da un .txt por PDF.

¿Se envía el documento a algún sitio para leerlo?

No. El reconocimiento funciona en tu navegador, con el motor Tesseract. La primera vez, MovaDoc descarga de su propio sitio el motor y los datos de los idiomas; después, funciona incluso sin internet. El PDF y el texto reconocido nunca salen de tu dispositivo.