Saltar para o conteúdo

Como tornar um PDF pesquisável

Atualizado em 7 de outubro de 2026

Uma digitalização é só uma fotografia da página: por muito que o texto pareça texto, não o consegues selecionar, copiar nem procurar. O reconhecimento de texto, conhecido por OCR, lê as palavras da imagem e guarda-as no PDF. Com o OCR PDF fazes isso no teu dispositivo.

Abrir OCR PDFOs ficheiros ficam no teu dispositivo.

Como saber se o teu PDF é uma digitalização

Abre o PDF e tenta selecionar uma frase com o rato, ou procura uma palavra com Ctrl+F (⌘F no Mac). Se não conseguires, as páginas são imagens e precisas do reconhecimento de texto.

Tornar o PDF pesquisável, passo a passo

  1. Abre o OCR PDF e arrasta o PDF digitalizado para a área de trabalho. Podes escolher vários de uma vez.
  2. Marca as «Línguas do documento»: português, inglês, espanhol, francês, alemão ou italiano, também misturados no mesmo documento. Escolhe só as que o documento tem.
  3. Escolhe a «Qualidade»: «Rápido» ou «Preciso».
  4. Carrega em «Reconhecer texto». Da primeira vez, o MovaDoc descarrega antes os dados do reconhecimento (alguns megabytes), logo que começas a usar a ferramenta.
  5. Descarrega o PDF pesquisável («Descarregar PDF») ou só o texto («Descarregar o texto (.txt)»).

Rápido ou Preciso

«Rápido» é mais leve e chega para texto impresso nítido. «Preciso» reconhece melhor letras pequenas e digitalizações fracas, mas demora mais. Num computador, cada página demora alguns segundos; num telemóvel, pode demorar bastante mais.

Como melhorar o resultado

  • Endireita as páginas: uma página digitalizada de lado tem de ser rodada primeiro, com o Organizar PDF.
  • Dá preferência a digitalizações nítidas e com contraste: texto desfocado ou torto dá mais erros.
  • Escolhe só as línguas do documento: cada língua a mais torna o reconhecimento mais lento.

O que o OCR não faz

A escrita à mão não é reconhecida. Nas tabelas, as palavras ficam pesquisáveis, mas o texto copiado perde a forma da tabela. E o reconhecimento pode ler mal uma letra ou um algarismo (um O por um 0, por exemplo), por isso confirma sempre o que for importante, como valores, datas, IBAN e números de documentos.

Só quero o texto, ou um documento editável

Se só precisas do texto, o PDF para texto cria um ficheiro .txt (e oferece-se para reconhecer o texto numa digitalização). Se queres editar o documento, o PDF para Word reconhece o texto das páginas digitalizadas e cria um .docx.

O que confirmar no fim

  • Procura no PDF novo uma palavra que saibas que está no documento: aparece nos resultados?
  • As páginas parecem iguais às originais? O que se vê não muda: o texto reconhecido fica escondido por cima.
  • Os números importantes estão certos? Compara alguns com o original.

Perguntas frequentes

Precisa de internet?

Da primeira vez, sim: o MovaDoc descarrega do próprio site o motor e os dados das línguas. Depois, funciona sem internet, porque os ficheiros ficam guardados no browser (numa janela privada, só até a fechares). Quando escolhes outra língua ou outra qualidade, é preciso internet outra vez.

O PDF é enviado para algum servidor?

Não. O reconhecimento corre no teu browser, com o motor Tesseract. O teu PDF nunca sai do dispositivo.

Reconhece escrita à mão?

Não. O reconhecimento serve para texto impresso.

O que muda no PDF?

O que se vê fica igual: o texto reconhecido é acrescentado, invisível, por cima de cada página, no sítio de cada palavra. Assim podes selecionar, copiar e procurar o texto. Se o PDF tiver uma assinatura digital, ela deixa de ser válida: o MovaDoc avisa-te antes.