Aller au contenu
Klarfile

Extraire le texte d'un PDF en .txt

Tout le texte du document sort dans un fichier .txt, page par page. Les pages sans texte sont signalées comme telles.

Ce que fait cet outil

Ce que ça ne fait pas : On rend le texte tel que le document le porte : les mots coupés en fin de ligne restent coupés, les colonnes ne sont pas démêlées, les tableaux ne sont pas reconstruits en tableaux. Une page scannée ne porte aucun texte, et l'extraction le dit plutôt que de rendre un fichier vide. « Rendre un scan cherchable » la lit alors et y pose le texte reconnu ; l'extraction fonctionne ensuite sur le document produit, sans le redéposer.

Aucun fichier n'est téléversé. Coupez le réseau une fois cette page chargée : l'outil continue de fonctionner. Comment le vérifier vous-même.

Les autres outils