Zum Inhalt springen

So machst du ein PDF durchsuchbar

Aktualisiert am 7. Oktober 2026

Ein Scan ist nur ein Foto der Seite: Auch wenn der Text wie Text aussieht, kannst du ihn weder markieren noch kopieren noch durchsuchen. Die Texterkennung, kurz OCR, liest die Wörter aus dem Bild und speichert sie im PDF. Mit OCR PDF machst du das auf deinem Gerät.

„OCR PDF“ öffnenDeine Dateien bleiben auf deinem Gerät.

So erkennst du, ob dein PDF ein Scan ist

Öffne das PDF und versuche, einen Satz mit der Maus zu markieren, oder suche mit Strg+F (auf dem Mac ⌘F) nach einem Wort. Klappt das nicht, sind die Seiten Bilder, und du brauchst die Texterkennung.

PDF durchsuchbar machen – Schritt für Schritt

  1. Öffne OCR PDF und zieh das gescannte PDF in den Arbeitsbereich. Du kannst auch mehrere auf einmal auswählen.
  2. Kreuze die „Sprachen des Dokuments“ an: Deutsch, Englisch, Französisch, Italienisch, Portugiesisch oder Spanisch, auch gemischt im selben Dokument. Wähle nur die, die im Dokument vorkommen.
  3. Wähle die „Qualität“: „Schnell“ oder „Genau“.
  4. Klicke auf „Text erkennen“. Beim ersten Mal lädt MovaDoc die Daten für die Texterkennung (einige Megabyte) schon vorher herunter, sobald du das Tool zu nutzen beginnst.
  5. Lade das durchsuchbare PDF („PDF herunterladen“) oder nur den Text („Text herunterladen (.txt)“) herunter.

Schnell oder Genau

„Schnell“ ist kompakter und reicht für klar gedruckten Text. „Genau“ erkennt kleine Schrift und schwache Scans besser, braucht aber länger. Am Computer dauert jede Seite einige Sekunden, auf dem Smartphone kann es deutlich länger dauern.

So verbesserst du das Ergebnis

  • Richte die Seiten gerade aus: Eine seitlich gescannte Seite musst du zuerst mit PDF organisieren drehen.
  • Nimm möglichst scharfe Scans mit gutem Kontrast: Unscharfer oder schiefer Text führt zu mehr Fehlern.
  • Wähle nur die Sprachen des Dokuments: Jede zusätzliche Sprache macht die Erkennung langsamer.

Was OCR nicht kann

Handschrift wird nicht erkannt. In Tabellen werden die Wörter durchsuchbar, aber kopierter Text verliert die Tabellenform. Und die Texterkennung kann einen Buchstaben oder eine Ziffer falsch lesen (zum Beispiel ein O statt einer 0). Prüfe deshalb immer alles Wichtige, etwa Beträge, Datumsangaben, IBANs und Identifikationsnummern.

Nur der Text oder ein bearbeitbares Dokument

Wenn du nur den Text brauchst, erstellt PDF in Text eine .txt-Datei (und bietet bei einem Scan an, den Text zu erkennen). Wenn du das Dokument bearbeiten willst, erkennt PDF in Word den Text gescannter Seiten und erstellt eine .docx-Datei.

Was du am Ende prüfen solltest

  • Suche im neuen PDF nach einem Wort, von dem du weißt, dass es im Dokument steht: Erscheint es in den Suchergebnissen?
  • Sehen die Seiten aus wie die Originale? Was man sieht, ändert sich nicht: Der erkannte Text liegt unsichtbar darüber.
  • Stimmen die wichtigen Zahlen? Vergleiche einige mit dem Original.

Häufige Fragen

Brauche ich dafür Internet?

Beim ersten Mal ja: MovaDoc lädt die Engine und die Sprachdaten von der eigenen Website herunter. Danach funktioniert es ohne Internet, weil die Dateien im Browser gespeichert bleiben (in einem privaten Fenster nur, bis du es schließt). Wenn du eine andere Sprache oder Qualität wählst, brauchst du wieder Internet.

Wird das PDF auf einen Server hochgeladen?

Nein. Die Texterkennung läuft in deinem Browser, mit der Tesseract-Engine. Dein PDF verlässt nie dein Gerät.

Wird Handschrift erkannt?

Nein. Die Texterkennung ist für gedruckten Text gedacht.

Was ändert sich am PDF?

Das Aussehen bleibt gleich: Der erkannte Text wird unsichtbar über jede Seite gelegt, genau an die Stelle jedes Wortes. So kannst du den Text markieren, kopieren und durchsuchen. Ist das PDF digital signiert, verliert die Signatur ihre Gültigkeit: MovaDoc weist dich vorher darauf hin.