Convertir un PDF en texte (les mots, rien d'autre)
La réponse courte
Pour convertir un PDF en texte brut, ouvrez-le et copiez-collez le texte s’il est numérique — ou téléversez-le sur un convertisseur qui produit un fichier .txt. Les PDF scannés nécessitent d’abord une OCR (voir extraire le texte d’un PDF). Le résultat est du texte pur : pas de mise en forme, pas d’images, pas de mise en page — exactement ce qu’il faut pour éditer, citer ou alimenter un autre outil.
Le plus rapide : copier-coller
- Ouvrez le PDF dans n’importe quel lecteur.
- Sélectionnez tout le texte (Ctrl/Cmd+A), copiez-le, collez-le dans votre éditeur.
- Terminé — zéro outil, ça marche sur tous les appareils.
Ça couvre la plupart des PDF numériques. Si la sélection est grisée, le fichier est protégé en copie — c’est un verrou de permissions, amovible si vous connaissez le mot de passe.
Convertir un PDF en texte avec un outil
Quand le copier-coller n’est pas pratique — un manuel de 200 pages, ou du texte dont vous voulez nettoyer les en-têtes et pieds de page — utilisez un convertisseur : téléversez le PDF, téléchargez le .txt. Les bons suppriment automatiquement les numéros de page et les en-têtes, et certains permettent de choisir des plages de pages.
Pour du texte qui garde sa structure (titres, listes), le convertisseur PDF vers Markdown est le meilleur choix — le Markdown est du texte brut avec structure, et il se convertit proprement en HTML, Word ou documents. Si vous voulez littéralement un .txt brut, un convertisseur simple suffit.
La partie honnête
Ce que vous perdez en convertissant en texte :
- Tout ce qui est visuel. Les tableaux s’aplatissent en texte courant, les colonnes fusionnent, les images disparaissent. Le texte est tout là, mais le lire donne l’impression d’écouter la transcription radio d’un film.
- Les scans nécessitent une OCR. Une page scannée n’a pas de couche texte — les convertisseurs ne peuvent pas extraire ce qui n’existe pas. Faites l’OCR d’abord, acceptez les erreurs sur les scans médiocres.
- L’ordre peut changer. Les mises en page multi-colonnes sont extraites dans l’ordre des colonnes, pas l’ordre de lecture — une newsletter à deux colonnes ressort donc en colonne A puis colonne B. Agaçant, mais prévisible.
Vérification d’usage : les fichiers texte servent au contenu — citation, archivage, alimentation de scripts ou d’outils IA. Si le but est un document lisible, gardez le PDF ou convertissez vers un format qui préserve la structure.