315 outils gratuits, sans inscription ni installation, tout se passe dans votre navigateur.
315 outils gratuits, sans inscription ni installation, tout se passe dans votre navigateur.
Extrayez le texte d'un PDF, page par page
Récupérer le texte d'un PDF sert à le citer, le traduire, le corriger ou simplement le relire ailleurs, sans repasser par un traitement de texte qui reformate tout. Cet outil lit votre document dans le navigateur et en sort le texte page par page, avec ou sans repère de numéro de page, prêt à copier ou à télécharger en fichier .txt. Il recompose les lignes plutôt que de coller les fragments bout à bout, ce qui compte parce qu'un PDF ne connaît pas la notion de ligne : il ne contient que des morceaux de texte posés à des coordonnées. Le document ne quitte jamais votre appareil, ce qui importe quand il s'agit d'un contrat ou d'un bulletin de paie.
Parce qu'il est très probablement scanné. Un document passé au scanner ou photographié est une image : il n'y a aucune couche de texte à extraire, même si vos yeux y lisent des mots. L'outil vous le signale au lieu d'afficher un cadre vide. Récupérer ce texte demande une reconnaissance optique de caractères, un traitement différent que cet outil ne fait pas.
Les lignes et les paragraphes le sont, ainsi que la séparation entre les pages si vous la demandez. Les colonnes, les tableaux et les encadrés, non : ce sont des positions dans la page, pas une structure, et aucun outil d'extraction ne peut les restituer avec certitude. Sur un document en deux colonnes, relisez le résultat avant de le réutiliser.
Rien ne sort de votre navigateur. La lecture du PDF se fait entièrement sur votre appareil, contrairement à la plupart des convertisseurs en ligne, qui téléversent le document sur leurs serveurs et le conservent un temps variable.
Un résultat qui vous paraît faux, une valeur périmée, un cas qui manque ? Signalez-le à contact@topapps.fr