Extraire le texte PDF

Convertir le texte PDF consultable en TXT

Sélectionnez les pages dont vous avez besoin et extrayez leur couche de texte existante dans un fichier texte UTF-8 sans télécharger le PDF.

PDF en texte
Vos fichiers restent dans ce navigateur. Rien n'est téléchargé sur un serveur.
PDF en texte en ligne gratuit - Extraire TXT

Extraire le texte des pages PDF

Choisissez les pages à lire, prévisualisez-les et téléchargez leur texte consultable sous forme de fichier TXT.

Déposez les fichiers PDF ici

Vos fichiers restent dans ce navigateur. Rien n'est téléchargé sur un serveur.

Transformez un PDF consultable en texte brut modifiable

L'extraction de texte PDF est utile lorsque vous avez besoin de contenu pour des notes, des recherches, des citations, des flux de travail d'accessibilité ou un autre éditeur de texte.

Choisissez toutes les pages ou uniquement les pages dont vous avez besoin. La sortie sépare chaque page avec un en-tête clair et utilise le codage UTF-8.

Cet outil lit le calque de texte PDF localement. Il n'effectue pas d'OCR, donc les pages numérisées contenant uniquement des images ne peuvent pas contenir de texte extractible.

Ce que comprend l'extraction de texte

Pages sélectionnables

Extrayez l'intégralité du document ou choisissez des pages individuelles dans la grille d'aperçu.

Sections de page lisibles

Chaque page sélectionnée reçoit un en-tête afin que son emplacement source reste clair.

Sortie UTF-8

Le fichier TXT prend en charge l'anglais, le chinois et d'autres textes Unicode trouvés dans le PDF.

Comment ça marche

1

Choisissez un PDF

Ouvrez le fichier localement et préparez ses aperçus de page.

2

Sélectionner des pages

Gardez toutes les pages sélectionnées ou choisissez uniquement les pages dont vous avez besoin du texte.

3

Télécharger le texte

Extrayez le calque de texte et enregistrez un fichier texte UTF-8.

Questions

Mon PDF est-il téléchargé sur un serveur ?+

Non. Le calque de texte PDF est lu localement dans votre navigateur.

Cet outil effectue-t-il l'OCR ?+

Non. Il extrait le texte interrogeable existant et ne reconnaît pas le texte à l’intérieur des images numérisées.

Puis-je extraire uniquement certaines pages ?+

Oui. Sélectionnez ou désélectionnez des pages avant d’extraire le texte.

Pourquoi certains textes sont-ils hors d'usage ?+

Les PDF stockent le texte par position plutôt que par paragraphes. Des colonnes complexes ou des dispositions décoratives peuvent produire un ordre de lecture différent.

Quelles langues sont prises en charge ?+

La sortie UTF-8 peut contenir tous les caractères Unicode disponibles dans la couche de texte PDF.