Convertir un DOCX en TXT
Récupérez le texte d'un document Word — numérotation des listes, tableaux et notes de bas de page intacts, sans rien en double — prêt à copier ou à enregistrer en fichier .txt. Rien n'est conservé, jamais.
- Jamais conservé
- Pas de file d'attente, pas d'attente
- Sans inscription, sans filigrane
Comment ça marche
Ajoutez votre document
Déposez un fichier .docx sur la page. Le texte apparaît aussitôt.
Choisissez ce que vous gardez
Tableaux en lignes séparées par des tabulations ou en colonnes alignées, en-têtes et pieds de page, notes de bas de page, et fins de ligne Windows ou Mac/Linux.
Copiez ou téléchargez
Modifiez le texte si vous le souhaitez, puis copiez-le ou enregistrez-le en fichier .txt UTF-8.
Garder les mots, écarter tout le reste
Un .docx est une archive ZIP de fichiers XML, et le texte se trouve dans l'une de ses parties. Son extraction est donc fiable, contrairement à l'extraction du texte d'un PDF : les mots sont stockés en tant que mots, dans l'ordre de lecture, sans positions de glyphes à reconstituer ni doute sur la colonne qui vient en premier. Quoi que perde cette conversion, elle ne perd ni ne réordonne le texte.
Ce que le texte brut ne peut pas contenir, c'est tout le reste, par définition : gras et italique, polices et tailles, couleurs, mise en page, en-têtes et pieds de page. La structure est préservée là où le texte brut a une convention pour elle — les paragraphes restent séparés, les éléments de liste gardent leurs repères et leur retrait, et les cellules de tableau sont séparées pour que les lignes restent lisibles au lieu de se fondre en une seule ligne interminable. Les notes de bas de page sont regroupées plutôt que supprimées, puisque le texte d'une note reste du texte.
Les images, graphiques et SmartArt sont omis — ils ne contiennent aucun texte à extraire, et un espace réservé n'aiderait personne. Les équations sortent sous une forme linéaire simple, comme a/b + x^2, plutôt qu'en symboles : c'est le compromis honnête — lisible, sans ambiguïté, et sans prétendre faire de la composition typographique.
Deux remarques pratiques. Les modifications suivies et les commentaires ne sont pas inclus — vous obtenez le document tel qu'il se lit actuellement, pas son historique de révisions, ce qui est bon à savoir si vous espériez récupérer un passage supprimé. Et les anciens fichiers .doc doivent d'abord être enregistrés en .docx, car le format binaire de 1997 est tout autre chose, qui se trouve simplement servir au même usage.
Si vous cherchez autre chose
Pandoc convertit un .docx en texte ou en Markdown avec bien plus de contrôle : pandoc in.docx -t plain -o out.txt pour du texte brut, ou -t markdown pour garder titres, emphase et listes sous forme de balisage lisible — ce que veulent généralement les gens quand ils demandent « juste le texte ». Il extrait aussi les images dans un dossier au lieu de les écarter.
Pour extraire le texte de centaines de documents, les bibliothèques Python python-docx et docx2txt vous donnent les paragraphes par programme : vous pouvez les filtrer, les rechercher ou les indexer au lieu de lire un fichier. Et pour accéder spécifiquement aux modifications suivies ou aux commentaires, ni un convertisseur ni un script ne vaut l'ouverture du document — ces informations sont dans le fichier, mais ne font tout simplement pas partie du « texte ».
Questions fréquentes
Mon document est-il conservé quelque part ?
Non. Le document n'est jamais conservé et rien n'est envoyé nulle part — ce qui compte pour les contrats, les CV et tout ce que vous ne colleriez pas dans un site web.
Les numéros de liste sont-ils conservés ?
Oui, exactement comme Word les affiche : « 1. », « 1.1 », « a) », « iii. » et les puces, y compris les listes qui redémarrent ou se poursuivent dans le document. La plupart des extracteurs de texte suppriment complètement les numéros, car Word ne les stocke pas sous forme de texte.
Comment les tableaux sont-ils convertis ?
À votre choix. Les lignes séparées par des tabulations se collent directement dans Excel ou Google Sheets ; les colonnes alignées se lisent bien en texte brut, avec des largeurs qui restent justes même pour les caractères chinois ou japonais.
Et les modifications suivies et les commentaires ?
Le texte se lit comme si toutes les modifications avaient été acceptées : les suppressions sont omises, les insertions conservées. Les commentaires ne sont pas inclus.
Les zones de texte, notes de bas de page, en-têtes et pieds de page sont-ils inclus ?
Les zones de texte sont toujours incluses, une seule fois chacune, dans l'ordre de lecture. Les notes de bas de page et de fin apparaissent sous forme de repères [1], avec les notes listées à la fin, et les en-têtes et pieds de page peuvent être activés.
Quel est l'encodage du fichier .txt ?
UTF-8, que tous les éditeurs modernes ouvrent correctement et qui peut contenir toutes les langues. Choisissez les fins de ligne Windows si le fichier est destiné à un ancien programme Windows.
Bon à savoir : Les anciens fichiers .doc doivent d'abord être enregistrés en .docx, et le mot de passe des documents protégés doit être retiré. Les images, graphiques et SmartArt sont omis ; les équations sortent sous une forme linéaire simple, comme a/b + x^2.
Intégrez cet outil à votre site
Gratuit pour tout blog, page de cours ou article d'aide. Collez un seul extrait de code et vos visiteurs pourront l'utiliser directement sur votre page.
Outils associés
PDF en texte
Du texte brut à copier et modifier
TXT en PDF
Textes ou notes dans un PDF soigné
HTML en DOCX
Pages web en documents Word modifiables
Traduire DOCX
Documents Word dans une autre langue, mise en page intacte
Créer un CV
Un CV professionnel, 54 modèles au choix
Markdown en HTML
Du Markdown en page web propre ou en extrait HTML