Klarfile

Extraire le texte d'un PDF en .txt

Le copier-coller depuis un lecteur de PDF rend une bouillie, et ne rend rien du tout sur un scan — sans qu'on sache si c'est le document ou le geste qui a échoué. Ici, on le dit.

Ce que fait cet outil

Ce que ça ne fait pas : On rend le texte tel que le document le porte : les mots coupés en fin de ligne restent coupés, les colonnes ne sont pas démêlées, les tableaux ne sont pas reconstruits en tableaux. Deviner ces choses-là, c'est se tromper en silence, et un texte faussement propre est pire qu'un texte brut. Une page scannée ne porte aucun texte : il n'y a pas de reconnaissance de caractères ici, et il n'y en aura pas — elle demanderait une bibliothèque de plusieurs mégaoctets qu'il faudrait aller chercher ailleurs, ce que ce site s'interdit.

Aucun fichier n'est téléversé. Coupez le réseau une fois cette page chargée : l'outil continue de fonctionner. Comment le vérifier vous-même.

Les autres outils