Aller au contenu

Compter les mots

Mots, phrases, paragraphes et temps de lecture — mis à jour pendant que vous tapez. Juste pour les langues qui ne séparent pas les mots par des espaces, ce que la plupart des compteurs ratent. Rien n'est conservé.

  • Jamais conservé
  • Pas de file d'attente, pas d'attente
  • Sans inscription, sans filigrane

0

Mots

toutes langues

0

Caractères

un emoji compte pour un

0

Phrases

abréviations gérées

0

Paragraphes

séparés par des lignes vides

Tous les comptages, et à quoi ils servent
LignesNumérotées comme dans un éditeur
0
PhrasesPas coupées par « M. » ou « etc. »
0
ParagraphesBlocs séparés par une ligne vide
0
Points de codeCe que capture le « . » d'une expression régulière
0
Unités UTF-16Ce que renvoie string.length en JavaScript
0
Octets UTF-8Ce que mesurent une limite VARCHAR et les en-têtes HTTP
0
Temps de lectureEn silence, à 238 mots par minute
—
Temps de paroleÀ voix haute, à 150 mots par minute
—
Mot le plus longEn caractères, pas en octets
—
Mot moyenUn indicateur approximatif de lisibilité
—

Commencez à taper et tout se remplit. Essayez un emoji ou une phrase en chinois — les deux sont comptés comme le ferait une personne, ce que la plupart des compteurs font mal.

Comment ça marche

1

Collez ou tapez

Ou déposez un fichier texte. Le compte se met à jour au fil de la saisie ; rien n'est envoyé nulle part.

2

Lisez les chiffres

Mots, phrases, paragraphes, lignes et caractères, plus les temps de lecture et de parole.

3

Vérifiez vos limites

Si vous écrivez avec une limite — un titre SEO, une meta description, un SMS —, la page indique à quel point vous en êtes proche.

Ce qui est compté, et qui fait le comptage

Le nombre de mots ne vient pas de nous. Les mots sont fournis par le segmenteur Unicode du navigateur lui-même, interrogé avec sa langue par défaut plutôt qu'avec une langue précise, et la page garde les fragments qu'il signale comme des mots. Rien ici n'ajoute de règle pour les traits d'union, les apostrophes ou les chiffres : vous obtenez le jugement du segmenteur sur l'endroit où commencent les mots, ce qui explique pourquoi le résultat est juste en chinois et en japonais, et pourquoi deux navigateurs sur deux machines peuvent différer très légèrement sur un même texte. Sur un navigateur trop ancien pour disposer du segmenteur, la page se rabat sur un découpage aux espaces et vous indique que le chiffre est approximatif — c'est le nombre que les compteurs plus simples vous donnent en permanence, sans le dire.

Paragraphes et lignes sont comptés selon nos propres règles, et ce ne sont pas les mêmes. Une limite de paragraphe est une ligne vide — deux retours à la ligne séparés uniquement par des espaces ou des tabulations —, si bien qu'un fichier texte Windows déposé avec ses retours chariot intacts compte comme un seul paragraphe ; un texte collé dans la zone n'a jamais ce problème, car une zone de texte transmet des sauts de ligne. Les lignes sont comptées comme dans la marge d'un éditeur : une zone vide compte zéro ligne, un mot compte une ligne, et un fichier qui se termine par un retour à la ligne a une dernière ligne vide qui compte. Ce n'est volontairement pas ce que renvoie la commande wc, qui compte les caractères de fin de ligne.

Deux choix plus discrets tranchent la plupart des débats sur les chiffres. Le compte de caractères sans espaces retire tout ce que le navigateur considère comme un espace, y compris l'espace insécable qui arrive avec un texte copié depuis une page web — mais pas l'espace sans chasse, qui n'est pas un espace et reste dans le compte. Et le mot le plus long comme la longueur moyenne des mots sont mesurés en points de code plutôt qu'en graphèmes, l'unité qu'utilise le nombre de caractères principal : un mot contenant un emoji ou un accent combinant paraît donc plus long ici qu'à l'œil. Le tableau de fréquence masque une soixantaine de mots grammaticaux anglais courants, sauf si vous demandez à les voir, et ignore la casse selon la règle anglaise simple, quelle que soit la langue dans laquelle vous écrivez.

Si vous cherchez autre chose

Quand un logiciel précis va juger, seul le chiffre de ce logiciel compte. Une revue qui annonce huit mille mots bibliographie comprise parle du chiffre que produit Word, et Word compte les champs, les notes de bas de page, les légendes et les zones de texte selon ses propres réglages. Cette page tombera près sur de la prose ordinaire, mais pas au mot près : fiez-vous à l'outil qui vous évalue plutôt qu'à celui-ci.

Au-delà d'un document, le comptage tient en une ligne de commande. wc -w traite tout un dossier d'un coup et lit en flux des fichiers plus gros que votre mémoire ; pour du Markdown, du HTML ou du LaTeX, faire d'abord passer le fichier par pandoc pour le convertir en texte brut retire le balisage, afin que les blocs de code, les cibles de liens et les balises ne soient pas comptés comme de la prose — c'est l'écart entre le nombre de mots d'un dépôt et le vrai. Ni l'un ni l'autre n'est à la portée d'une zone de collage pour quatre cents fichiers.

Questions fréquentes

Mon texte est-il conservé quelque part ?

Non. Rien n'est conservé et aucune requête n'est envoyée, et l'outil continue de fonctionner réseau déconnecté. Pour du texte, c'est plus important qu'il n'y paraît : ce que l'on colle dans un compteur en ligne, ce sont des écrits non publiés, des projets d'actes juridiques, des travaux d'étudiants et des documents internes.

Fonctionne-t-il pour le chinois, le japonais ou le thaï ?

Oui, et c'est ce qui le distingue le plus de la plupart des compteurs. Ces langues ne séparent pas les mots par des espaces : la méthode habituelle — découper sur les espaces — compte donc un article chinois entier comme un seul mot. Cet outil utilise la segmentation Unicode en mots du navigateur (l'algorithme UAX #29), qui sait où les mots commencent et finissent réellement, dans toutes les écritures. Collez un texte chinois dans cette page et dans un autre compteur côte à côte : la différence saute aux yeux.

Comment le temps de lecture est-il calculé ?

Le nombre de mots divisé par 238 par minute pour la lecture silencieuse, et par 150 par minute pour la lecture à voix haute. Le chiffre de 238 provient de la méta-analyse de Brysbaert (2019), portant sur 190 études de la lecture silencieuse chez l'adulte, plutôt que des chiffres ronds de 200 ou 250 recopiés d'un article de blog à l'autre. C'est une moyenne pour de la prose ordinaire — un texte technique dense se lit plus lentement, un sujet familier plus vite.

Qu'est-ce qui compte comme une phrase ?

Une phrase se termine par un point, un point d'interrogation ou un point d'exclamation — mais pas après un titre ou une abréviation. « We met Dr. Smith on Monday. » forme une seule phrase, pas deux : la segmentation du navigateur se trompe sur ce point, et cette page corrige l'erreur. « Bring pens, paper, etc. and we will start » n'en fait aussi qu'une ; la même expression suivie d'une majuscule en fait deux.

Qu'est-ce qui compte comme un paragraphe ?

Un bloc de texte séparé par une ligne vide. Compter chaque retour à la ligne comme un paragraphe ferait de chaque ligne d'une adresse un paragraphe, c'est pourquoi les chiffres affichés ici diffèrent de ceux de certains autres outils.

Compte-t-il les mots d'un document Word ou d'un PDF ?

Pas directement — collez-y le texte, ou passez d'abord par notre outil PDF en texte et collez le résultat. Cette page travaille sur du texte, et c'est ce qui la rend instantanée et confidentielle.

Pourquoi mon nombre de mots diffère-t-il de celui de Microsoft Word ?

Le plus souvent, à cause des traits d'union et des nombres. Word compte « well-known » comme un seul mot, et nous aussi ; certains outils en comptent deux. Les nombres, dates et symboles isolés sont comptés ici comme des mots lorsqu'ils contiennent un chiffre ou une lettre. Pour de la prose ordinaire, les deux concordent de près ; pour une liste de références de pièces, non.

Bon à savoir : Les temps de lecture et de parole sont des moyennes sur de la prose ordinaire — un texte technique dense se lit plus lentement et un sujet familier plus vite : considérez-les comme une indication, pas comme une promesse. Le comptage repose sur la segmentation Unicode du navigateur ; un navigateur trop ancien pour en disposer se rabat sur une estimation et l'indique sur la page.

Intégrez cet outil à votre site

Gratuit pour tout blog, page de cours ou article d'aide. Collez un seul extrait de code et vos visiteurs pourront l'utiliser directement sur votre page.