PDF en texte
Extrayez le texte d’un PDF dans un fichier texte brut (.txt), prêt à copier, à rechercher ou à modifier. Tout se passe sur votre appareil.
Traité sur votre appareilRien n’est envoyé sur un serveur
Glissez un ou plusieurs PDF ici
Fichiers PDF
Les fichiers sont ouverts sur votre appareil et ne sont jamais envoyés.
Comment ça marche
Choisissez le PDF
Faites glisser le fichier dans la zone de travail ou utilisez le bouton. Vous pouvez en choisir plusieurs à la fois.
Marquez les pages, si vous le souhaitez
Si vous voulez savoir où commence chaque page, activez « Marquer le début de chaque page ».
Téléchargez le texte
Vous obtenez un fichier .txt avec le texte de toutes les pages, dans l’ordre. Avec plusieurs PDF, vous obtenez un .txt pour chacun, regroupés dans un ZIP.
Questions fréquentes
Mes fichiers sont-ils envoyés sur un serveur ?
Non. Le texte est lu dans votre navigateur et le fichier .txt est créé sur votre appareil. Rien n’est envoyé.
Cela fonctionne-t-il avec des PDF numérisés ?
Oui. Si le PDF est une numérisation (les pages sont des images, sans texte enregistré), l’outil vous le signale et propose de reconnaître le texte (OCR), sur votre appareil. Pour choisir les langues ou créer un PDF consultable, utilisez « OCR PDF ».
La mise en forme est-elle conservée ?
Non. Un fichier .txt ne contient que du texte : vous obtenez les lignes et les paragraphes, dans l’ordre des pages, mais pas les polices, les couleurs ni les images. Dans les tableaux et les textes en colonnes, l’ordre n’est pas toujours parfait.
Dans quel format est le fichier ?
Du texte brut en UTF-8, avec les accents et les caractères de toutes les langues, et des retours à la ligne comme sous Linux et macOS. Il s’ouvre dans le Bloc-notes de Windows 10 ou 11, dans TextEdit, dans Word et dans n’importe quel éditeur de texte.
Certains caractères sortent mal. Pourquoi ?
Certains PDF enregistrent les lettres sans indiquer de quel caractère il s’agit (c’est le cas de PDF anciens ou créés par certains logiciels). Dans ce cas, aucun lecteur ne peut copier le bon texte. Dans les PDF anciens en chinois, en japonais ou en coréen dont les polices ne sont pas incorporées, une partie du texte peut ne pas sortir.