Tout le texte du document sort dans un fichier .txt, page par page. Les pages sans texte sont signalées comme telles.
Ce que ça ne fait pas : On rend le texte tel que le document le porte : les mots coupés en fin de ligne restent coupés, les colonnes ne sont pas démêlées, les tableaux ne sont pas reconstruits en tableaux. Une page scannée ne porte aucun texte, et l'extraction le dit plutôt que de rendre un fichier vide. « Rendre un scan cherchable » la lit alors et y pose le texte reconnu ; l'extraction fonctionne ensuite sur le document produit, sans le redéposer.
Aucun fichier n'est téléversé. Coupez le réseau une fois cette page chargée : l'outil continue de fonctionner. Comment le vérifier vous-même.