Zum Inhalt springen

PDF in Text umwandeln

Extrahiere den Text eines PDFs in eine reine Textdatei (.txt), bereit zum Kopieren, Durchsuchen oder Bearbeiten. Alles passiert auf deinem Gerät.

Auf deinem Gerät verarbeitetNichts wird auf Server hochgeladen

Ein oder mehrere PDFs hierher ziehen

PDF-Dateien

Die Dateien werden auf deinem Gerät geöffnet und nie hochgeladen.

So funktioniert’s

  1. PDF auswählen

    Zieh die Datei in den Arbeitsbereich oder nutze die Schaltfläche. Du kannst auch mehrere auf einmal auswählen.

  2. Seitenanfänge kennzeichnen (optional)

    Wenn du sehen möchtest, wo jede Seite beginnt, aktiviere „Seitenanfänge kennzeichnen“.

  3. Text herunterladen

    Du erhältst eine .txt-Datei mit dem Text aller Seiten, in der richtigen Reihenfolge. Bei mehreren PDFs bekommst du für jedes eine eigene .txt-Datei, zusammen in einer ZIP-Datei.

Häufige Fragen

Werden meine Dateien auf einen Server hochgeladen?

Nein. Der Text wird in deinem Browser gelesen, und die .txt-Datei wird auf deinem Gerät erstellt. Es wird nichts hochgeladen.

Funktioniert das mit gescannten PDFs?

Ja. Wenn das PDF ein Scan ist (die Seiten sind Bilder ohne gespeicherten Text), weist dich das Tool darauf hin und bietet an, den Text auf deinem Gerät zu erkennen (OCR). Um die Sprachen zu wählen oder ein durchsuchbares PDF zu erstellen, verwende „OCR PDF“.

Bleibt die Formatierung erhalten?

Nein. Eine .txt-Datei enthält nur Text: Zeilen und Absätze bleiben in der Reihenfolge der Seiten erhalten, Schriftarten, Farben und Bilder aber nicht. Bei Tabellen und mehrspaltigem Text ist die Reihenfolge eventuell nicht perfekt.

In welchem Format ist die Datei?

Reiner Text in UTF-8, mit Umlauten, Akzenten und Zeichen aus jeder Sprache, und mit Zeilenumbrüchen wie unter Linux und macOS. Die Datei lässt sich im Editor von Windows 10 oder 11, in TextEdit, in Word und in jedem anderen Texteditor öffnen.

Manche Zeichen werden falsch ausgegeben. Woran liegt das?

Manche PDFs speichern Buchstaben, ohne festzuhalten, um welches Zeichen es sich jeweils handelt (das kommt bei älteren PDFs oder bei PDFs aus bestimmten Programmen vor). Dann kann kein PDF-Reader den richtigen Text kopieren. Bei älteren PDFs auf Chinesisch, Japanisch oder Koreanisch ohne eingebettete Schriftarten fehlt eventuell ein Teil des Textes.