PDF en texte

Envoyez un PDF et récupérez un fichier .txt brut contenant le texte qui s’y trouve déjà. Gratuit, sans compte, sans filigrane.

Gratuit – Sans inscription – Résultat complet

Gratuit, résultat complet

Sans filigrane, sans limite de pages, sans quota quotidien et sans compte. Vous téléchargez le document entier.

Confidentiel par conception

Les fichiers transitent en HTTPS et sont supprimés du serveur dès la fin du traitement. Nous ne conservons aucune copie de vos documents.

Accepte PDF

Envoyez le fichier directement depuis votre appareil ; le résultat est prêt à télécharger en quelques secondes.

Rien à installer

Fonctionne dans tout navigateur récent, sur ordinateur comme sur mobile. Les fichiers courants sont traités en quelques secondes.

Comment ça marche

1

Envoyez le PDF

Déposez un PDF dans la zone d’envoi. Les fichiers jusqu’à 100 Mo sont acceptés.

2

Laissez lire la couche de texte

Le texte stocké dans le fichier est lu sur notre serveur avec pdf.js, page après page, exactement tel qu’il a été enregistré.

3

Téléchargez le fichier .txt

Vous obtenez un fichier texte UTF-8 nommé d’après votre PDF, prêt à être collé, recherché ou repris par un autre outil.

Le texte qui se trouve déjà dans le fichier

La plupart des PDF portent leurs mots comme du vrai texte, et non comme une image. Un fichier exporté depuis Word, Google Docs, un logiciel de comptabilité ou un site web contient une couche de texte, avec les caractères, les espacements et les retours à la ligne. Cet outil lit cette couche avec pdf.js sur notre propre serveur et l’écrit dans un fichier .txt brut en UTF-8.

Comme rien n’est reconnu, réécrit ni deviné, le résultat est exact : les mots que vous obtenez sont ceux que le document stocke. L’extraction se termine en quelques secondes, même pour plusieurs centaines de pages, et le fichier que vous téléchargez porte le nom de celui que vous avez envoyé : contrat.pdf devient contrat.txt.

Quand un PDF n’a aucun texte à lire

Il y a une limite, et nous l’assumons. Si le PDF est une numérisation ou une photo de page, il contient une image et rien d’autre. Il n’y a pas de couche de texte à lire, cet outil ne peut donc rien extraire et le dit franchement plutôt que de vous remettre un fichier vide.

Ce comportement est délibéré. Reconnaître des mots à l’intérieur d’une image, c’est de l’OCR, et l’OCR coûte de l’argent pour chaque page traitée. Un outil gratuit ne devrait jamais dépenser cela en silence à votre place, nous nous arrêtons donc et vous indiquons le bon endroit. Utilisez OCR PDF pour ajouter une couche de texte interrogeable à la numérisation, puis revenez ici, ou utilisez PDF en Word, qui lit les numérisations dans le cadre de la conversion.

À quoi sert le texte brut

  • Citer un document. Obtenir une transcription nette d’un rapport que vous devez citer.
  • Alimenter un autre outil. Le texte brut est ce que veulent les index de recherche, les scripts et les tableurs.
  • Chercher et comparer. Deux fichiers .txt se comparent ligne à ligne dans n’importe quel éditeur.
  • Copier un contenu bloqué. Certaines visionneuses désactivent la sélection ; la couche de texte, elle, est bien là.

Vous n’avez besoin que d’une partie du document ? Divisez le PDF d’abord, puis extrayez le texte de la section qui compte. Si vous vérifiez un document par rapport à une version antérieure, Comparer PDF le fait côte à côte.

Questions fréquentes

Est-ce vraiment gratuit ?

+

Oui. L’extraction lit un texte qui se trouve déjà dans le fichier, elle ne nous coûte donc presque rien à exécuter. Pas de compte, pas de filigrane, pas de quota quotidien et pas de résultat tronqué.

Que se passe-t-il avec un PDF numérisé ?

+

Une numérisation est une image de page, pas du texte : il n’y a rien à extraire, et l’outil vous le dit au lieu de renvoyer un fichier vide ou inventé. Passez-le d’abord dans OCR PDF, ou utilisez PDF en Word, qui lit les numérisations dans le cadre de la conversion.

À quoi ressemble le fichier produit ?

+

Un seul fichier texte brut en UTF-8, nommé d’après votre PDF : rapport.pdf devient rapport.txt. Le texte suit l’ordre des pages du document et conserve ses retours à la ligne.

Pourquoi l’ordre du texte est-il parfois étrange ?

+

L’ordre vient du PDF lui-même. Les colonnes de type journal, les encadrés et les tableaux sont stockés comme des blocs de texte séparés, ils peuvent donc arriver entremêlés. Les rapports, les courriers et les contrats ordinaires ressortent propres.

Y a-t-il une limite de taille ?

+

Un PDF à la fois, jusqu’à 100 Mo. Le nombre de pages n’est pas plafonné ; un long document met seulement plus de temps à être envoyé, pas à être extrait.

Outils associés

Des tarifs simples : outils gratuits, un abonnement pour l’IA

Les outils de fichiers sont gratuits et sans limite. Les fonctions IA reposent sur un abonnement à crédits : chaque nouveau compte démarre avec 250 crédits gratuits, et les crédits de votre solde n’expirent jamais.

Voir tous les tarifs L’application iOS arrive bientôt sur l’App Store

Nous utilisons le stockage essentiel du navigateur pour vous garder connecté et faire fonctionner nos outils, ainsi que des statistiques d'usage anonymes qui ne déposent aucun cookie. Aucune publicité, aucun suivi entre sites.