Récupérez le contenu textuel d'un PDF pour le réutiliser ailleurs, le copier ou l'enregistrer en fichier texte. L'extraction se fait localement.
Collez l'URL de n'importe quelle page web et téléchargez-la en PDF.
Gratuit, sans inscription, rendu haute qualité via Chrome headless.
Copier proprement le contenu d'un PDF depuis un lecteur donne souvent un résultat décevant : lignes coupées, colonnes mélangées, en-têtes intercalés au milieu des phrases. L'extraction directe évite une partie de ces désagréments en récupérant le flux textuel du document.
Une distinction essentielle conditionne le résultat. Un PDF créé depuis un traitement de texte contient du texte véritable, que l'on peut extraire intégralement. Un PDF issu d'un scan ne contient que des images de pages : il n'y a aucun texte à récupérer, et l'extraction reviendra vide. Ce n'est pas un défaut de l'outil, mais la nature du fichier.
Pour savoir à quel type vous avez affaire, essayez de sélectionner un mot dans votre lecteur PDF habituel. Si la sélection fonctionne, l'extraction fonctionnera aussi. Sinon, il vous faudra un logiciel de reconnaissance optique de caractères.
Votre PDF est probablement issu d'un scan : il ne contient que des images de pages, sans texte. Vérifiez en essayant de sélectionner un mot dans votre lecteur habituel — si c'est impossible, il n'y a pas de texte à extraire.
Partiellement. L'extraction récupère le texte, pas la mise en forme. Les documents en colonnes ou avec des tableaux complexes donnent un résultat qui demande une relecture.
L'extraction traite le document entier. Pour cibler une page, divisez d'abord le PDF avec l'onglet Diviser, puis extrayez le texte du fichier obtenu.
Non. La lecture et l'extraction s'effectuent dans votre navigateur, ce qui permet de traiter un document confidentiel sans l'exposer.