0

Extraire le texte d'un PDF

Extrayez le texte brut du calque de texte d'un PDF dans le navigateur, page par page, prêt à être copié ou téléchargé.

📄

Glissez-déposer le document PDF ici

ou cliquez pour parcourir les fichiers PDF

Traitement... 0%
Chargement d'un document PDF
Lecture du calque de texte
Assemblage des pages
Rendement du bâtiment

Résultat

Cette page ouvre l'outil PDF en texte prêt à extraire le texte brut d'un document. Déposez un PDF et l'outil lit son calque de texte page par page, étiquette chaque bloc avec un marqueur « Page N » et affiche l'intégralité du résultat dans une boîte que vous pouvez copier ou télécharger sous forme de fichier .txt.

L'extraction de texte est le moyen le plus rapide de réutiliser les mots d'un PDF : citer une clause d'un contrat, déplacer le corps d'un rapport dans un éditeur, introduire du contenu dans un traducteur ou rechercher une expression dans un long document. Étant donné que le texte provient du calque de texte du PDF, il est exact : pas de conjectures OCR, pas de caractères mal lus.

Tout s'exécute localement dans votre navigateur via le moteur pdf.js, afin que les documents confidentiels ne quittent jamais votre appareil. Si le PDF est une numérisation sans couche de texte, l'outil vous l'indique clairement et vous oriente vers l'OCR plutôt que de renvoyer un fichier vide.