TextSorter
0
Mots
0
Caractères
0
Caract. (sans espaces)
0
Phrases
0
Paragraphes
0
Temps de Lecture
Objectif :
Saisissez ou collez du texte ci-dessus

Pourquoi "well-known" et une URL entière comptent chacun comme un seul mot

La règle est simple : le compteur tronque votre texte, le divise partout où un ou plusieurs espaces, tabulations ou sauts de ligne apparaissent, et compte ce qui reste. Rien de ce qui ne contient pas d'espace n'est divisé, peu importe le nombre d'idées distinctes qu'il contient réellement.

Vous collez
don't stop-believing
https://example.com/page 123
Nombre de mots
4
Vous tapezCompte pourPourquoi
well-known1 motAucun espace à l'intérieur, donc rien ne le divise en deux.
value/price1 motUne barre oblique n'est pas un espace, donc les deux moitiés restent collées l'une à l'autre.
https://example.com/page1 motUne URL entière sans espace interne est lue comme un seul bloc ininterrompu.
1231 motLe compteur ne cherche que des espaces, pas des lettres, donc un simple nombre sur sa propre ligne compte toujours.

Cette correspondance entre "un mot" et "un bloc délimité par des espaces" s'applique à presque tous les textes ordinaires, ce qui explique pourquoi le nombre sur cette page semble généralement correct sans qu'on y pense. don't se lit comme un seul mot car l'apostrophe se trouve à l'intérieur plutôt qu'autour, et une contraction est de toute façon exactement ce que la plupart des gens entendent par "un mot".

Cela ne fonctionne plus pour les textes construits à partir d'éléments qu'un humain compterait séparément mais qui ne sont jamais séparés par un espace. Un long code produit collé à un prix avec une barre oblique, un hashtag continu ou une URL collée sont tous lus comme un seul mot par ce compteur, même s'ils véhiculent plusieurs idées distinctes. Ce n'est pas un défaut spécifique à cet outil. Une simple division par les espaces est la même approche de base qu'utilise presque tous les compteurs de mots légers, par opposition à un tokeniseur complet en langage naturel qui comprend la grammaire et les formes des mots du dictionnaire.

Vous voulez un compte réel de "combien d'idées séparées" il y a ? Il n'y en a pas sur cette page. Ce que vous obtenez est un compte de blocs délimités par des espaces, ce qui est la définition de "mot" que chaque compteur simple, y compris celui-ci, utilise réellement sous le capot.

Pourquoi les textes en chinois, japonais et thaïlandais n'enregistrent presque aucun mot

C'est un véritable angle mort, pas un bug. Une division par espaces ne peut pas trouver les limites des mots dans une langue qui ne met pas d'espaces entre ses mots, de sorte qu'une phrase entière peut être enregistrée comme un seul "mot". Utilisez plutôt le compte de caractères pour ces langues.

Vous collez
我们今天去商店买了一些水果和面包
Cet outil signale
Words: 1
Characters: 16

Cette phrase signifie environ "nous sommes allés au magasin aujourd'hui et avons acheté des fruits et du pain", et un lecteur natif compterait environ une douzaine de mots distincts selon la grammaire de cette langue. Comme elle est tapée comme une suite continue de seize caractères sans espaces nulle part, cet outil, comme la plupart des compteurs de mots basés sur les espaces, la signale comme un seul mot. Rien d'inhabituel dans cette phrase. C'est simplement ce qui se produit chaque fois que la langue de saisie n'utilise pas d'espaces pour séparer les mots en premier lieu.

Le compteur de caractères n'a pas ce problème, puisqu'il compte chaque caractère indépendamment du fait que des espaces les séparent, ce qui est exactement pourquoi l'édition chinoise et japonaise a longtemps utilisé le nombre de caractères plutôt que le nombre de mots comme unité standard pour décrire la longueur. Un nombre de caractères contourne complètement la segmentation des mots, et la segmentation des mots dans ces langues est un problème linguistique véritablement plus difficile que la séparation par des espaces.

Vous écrivez ou traduisez dans une langue CJK ? Vérifiez si une exigence de longueur d'un client ou d'une plateforme est indiquée en caractères ou en mots avant de vous fier au chiffre ici. Les deux chiffres peuvent différer d'un ordre de grandeur pour le même passage exact, et le nombre de mots en particulier doit être considéré comme peu fiable pour ces langues plutôt que simplement faible.

Pourquoi cet outil, Microsoft Word et Google Docs ne sont jamais d'accord sur le même paragraphe

Différentes règles de tokenisation, pas un bug dans aucun d'eux. Chaque programme décide différemment où un mot se termine et où commence le suivant, de sorte que le même paragraphe peut produire trois décomptes légèrement différents.

Source de désaccordCe qui diffère
Gestion de la ponctuationLes traitements de texte appliquent leurs propres règles internes sur la façon dont les tirets, les points de suspension et les guillemets typographiques s'attachent aux mots voisins.
Traits d'union et contractionsCertains programmes traitent un mot composé avec un trait d'union comme un seul mot et d'autres comme deux, en utilisant une logique que cet outil n'essaie pas de reproduire.
Structure du documentWord peut inclure facultativement des notes de bas de page, des en-têtes, des pieds de page et des zones de texte dans son décompte, selon le mode de comptage actif. Cet outil ne compte toujours que le texte brut se trouvant dans l'éditeur.
Règle de séparationCet outil applique toujours une simple séparation par espaces, la même règle pour chaque langue et chaque type de texte, sans cas particuliers.

Rien de tout cela ne rend un chiffre plus "correct" qu'un autre. Il n'existe pas de norme universelle unique que suivent tous les traitements de texte, et la petite variation importe rarement pour les besoins quotidiens : vérifier la longueur approximative d'un article de blog, atteindre un objectif d'écriture quotidien, suivre les progrès sur un brouillon.

Vous travaillez avec une limite stricte et exacte ? Une soumission académique avec un plafond strict appliqué par un programme spécifique est exactement le cas où une différence d'un mot ou deux compte. Vérifiez deux fois le décompte à l'intérieur du programme qui fera l'évaluation, car c'est le nombre qui compte, pas celui-ci.

Pourquoi dix émojis peuvent afficher vingt caractères

"Caractères" compte chaque caractère que vous avez tapé, espaces inclus ; "Caractères (sans espaces)" supprime d'abord les espaces. Les deux chiffres peuvent être plus élevés que ce que vous compteriez à l'œil nu une fois que des émojis sont impliqués.

Vous collez
😀😀😀😀😀😀😀😀😀😀
Caractères signale
20

"Caractères" compte chaque caractère de votre texte, lettres, chiffres, ponctuation, espaces, tabulaciones et sauts de ligne, en traitant un espace exactement comme une lettre. "Caractères (sans espaces)" supprime d'abord tous les espaces et compte ensuite ce qui reste, de sorte qu'il ne reflète que le contenu visible, sans espace, que vous avez réellement tapé. L'écart entre les deux nombres est une indication approximative de la proportion de votre texte qui est constituée d'espaces : une liste à puces pleine de courtes lignes et de sauts de ligne montre un écart plus important qu'un paragraphe dense de prose continue.

Le cas des émojis ci-dessus ressemble à une erreur de comptage mais n'en est pas une. Le comptage des caractères en JavaScript, qui fait fonctionner cette page, mesure la longueur en unités de code UTF-16 plutôt qu'en symboles qu'un lecteur voit. La plupart des lettres et symboles occupent exactement une unité de code, mais de nombreux émojis courants, dont 😀, sont stockés en interne sous la forme de deux unités de code, appelées une paire de substitution. Dix d'entre eux tapés à la suite signalent un compte de caractères de vingt, pas de dix, même si un lecteur voit dix symboles.

Vous rédigez une légende riche en émojis avec une limite stricte de caractères ? Prévoyez environ deux caractères par émoji plutôt qu'un seul. Pour le texte brut, cette distinction n'a presque jamais d'importance, car les lettres et la ponctuation ordinaire sont des unités de code uniques, mais cela explique pourquoi le décompte ici peut être plus élevé que ce que vous comptez à l'œil nu une fois que les émojis sont de la partie.

Pourquoi une note d'un mot affiche le même temps de lecture qu'une note de 199 mots

Les deux sont arrondis à la même minute complète supérieure. Le temps de lecture est le nombre de mots divisé par 200, arrondi à la minute entière supérieure, et il n'affiche "<1m" que lorsque la case est complètement vide.

Mots tapésTemps de lecture affiché
0, case vide<1m
11m
1991m
2001m
2012m
4503m

Le chiffre de 200 mots par minute qui sous-tend ce calcul est une vitesse moyenne de lecture silencieuse fréquemment citée pour un adulte lisant de la prose ordinaire dans sa langue maternelle, et c'est une valeur par défaut raisonnable pour une estimation générale. Mais l'arrondi n'est pas progressif. Diviser par 200 et arrondir au chiffre supérieur signifie que tout nombre de mots compris entre 1 et 200 produit exactement le même résultat, une minute complète, et seul un éditeur complètement vide produit un résultat inférieur.

Ce taux fixe ne ralentit pas non plus pour les documents denses ou techniques. Une page de termes juridiques ou de code source prend nettement plus de temps à lire pour la plupart des lecteurs qu'une page de récit décontracté avec le même nombre de mots, et l'estimation ne prend pas du tout en compte les images, les vidéos intégrées ou les tableaux mélangés dans un article, car elle ne compte toujours que les mots. Considérez le chiffre comme une estimation de planification utile et honnête, une étiquette de "lecture de 3 minutes" sur un article de blog, plutôt que comme une prédiction précise du temps qu'un lecteur spécifique passera sur la page.

Il est facile de supposer que "<1m" signifie "moins de 200 mots". Ce n'est pas le cas. Cette étiquette n'apparaît que lorsqu'absolument rien n'est tapé. Dès qu'un seul mot se trouve sur la page, le temps de lecture est arrondi directement à une minute complète et y reste jusqu'à ce que le mot 201 le pousse à deux.

Pourquoi "Dr. Smith arrived at 3.5pm." compte comme quatre phrases

Le compteur de phrases ne peut pas distinguer la fin d'une vraie phrase d'un point à l'intérieur d'une abréviation ou d'une décimale. Il se divise à chaque suite de points, de points d'interrogation et de points d'exclamation, un point c'est tout.

Vous collez
Dr. Smith arrived at 3.5pm. He was late.
Phrases signale
4

Un lecteur humain voit deux phrases dans cette ligne. Le compteur en voit quatre, car il traite le point après "Dr", le point dans "3.5" et le point après "late" comme trois limites de phrase distinctes au lieu de reconnaître lesquelles sont de véritables fins. Il n'a aucune notion des abréviations, des nombres décimaux ou des initiales. Il sait seulement où se trouve un point, un point d'interrogation ou un point d'exclamation dans le texte.

Cela fonctionne bien pour la prose ordinaire écrite sans beaucoup d'abréviations, et c'est une règle simple et prévisible plutôt qu'une boîte noire. Les textes chargés de "Dr.", "p. ex.", "États-Unis" ou de prix comme "3.50 €" gonfleront le nombre de phrases bien au-delà de ce qu'une personne compterait à la main, de manière à peu près proportionnelle au nombre de points isolés qu'ils contiennent.

Considérez le compte de phrases comme une estimation sur les textes techniques ou riches en abréviations, pas comme un chiffre exact. Il est fiable sur les textes narratifs simples et de plus en plus optimiste à mesure qu'un passage contient des abréviations, des décimales et des initiales.

Pourquoi trois lignes avec retour à la ligne comptent comme trois paragraphes, pas un seul

Le compteur de paragraphes n'a rien à voir avec les lignes vides. Il compte chaque ligne qui a du contenu, qu'une ligne vide la sépare ou non de la ligne précédente.

Vous collez, une idée, retour manuel
This is line one
that continues here
and ends here.
Paragraphes signale
3

Il est tentant de supposer que les paragraphes sont comptés en cherchant une ligne vide entre les blocs de texte, de la même manière qu'un traitement de texte distingue un nouveau paragraphe d'un retour à la ligne souple. Ce n'est pas ce qui se passe ici. Trois lignes destinées à être lues comme un seul paragraphe, se terminant chacune par un saut de ligne manuel au lieu de revenir à la ligne naturellement, produisent un compte de paragraphes de trois, et non d'un, car le compteur n'a aucun moyen de savoir que ces trois lignes étaient censées rester ensemble.

Cela importe surtout pour les textes copiés à partir d'une source qui effectue un retour à la ligne manuel à chaque fois : les anciens fils de discussion par e-mail, certains exports PDF et certaines applications de prise de notes le font systématiquement. Un "paragraphe" dans le document d'origine peut arriver ici sous la forme de plusieurs lignes séparées plutôt que comme un bloc continu, et le nombre de paragraphes reflète ces sauts de ligne plutôt que la structure de paragraphe réelle de l'auteur.

Vous avez collé du texte d'un PDF ou d'un vieil e-mail et le nombre de paragraphes semble beaucoup trop élevé ? Vérifiez si la source ajoute des retours à la ligne manuels avant de vous fier au chiffre. Un nombre de paragraphes qui est étrangement proche du nombre de lignes en est généralement le signe, pas un problème de comptage.

Quel nombre de mots et de caractères devriez-vous réellement viser

Cela dépend de la destination du texte. Les plateformes sociales limitent par caractère, les champs de recherche tronquent par caractère, et les articles de blog sont jugés par le nombre de mots. Les chiffres pour chacun sont ci-dessous.

Plateforme ou contexteLimite
Publication X (anciennement Twitter)280 caractères
Légende Instagram2 200 caractères
Légende TikTok2 200 caractères
Publication LinkedIn3 000 caractères
Publication Facebook63 206 caractères
Balise titre SEO Googleenviron 50 à 60 caractères avant d'être tronquée
Méta-description Googleenviron 150 à 160 caractères avant d'être tronquée
Type de contenuNombre de mots typique
Réponse courte de blog300 à 600 mots
Article de blog standard1 000 à 2 500 mots
Guide approfondi2 000 à 4 000+ mots

Ces chiffres évoluent au fil du temps à mesure que les plateformes ajustent leurs limites, traitez-les donc comme une référence de travail plutôt que comme une garantie permanente, et consultez la documentation d'aide actuelle d'une plateforme avant de vous fier à un chiffre exact pour quelque chose d'important.

Rédigez en tenant compte de la limite au lieu de couper après. Les comptes de caractères et de mots ci-dessus sont mis à jour au fur et à mesure que vous tapez, ce qui rend pratique la rédaction d'un titre SEO, d'une légende ou d'une méta-description directement par rapport à son plafond plutôt que d'écrire librement d'abord et de couper une fois que vous découvrez que vous avez dépassé.

Façons courantes dont les gens utilisent un compteur de mots

Atteindre une longueur de devoir ou de soumission exacte

Un étudiant avec une exigence de "1 500 mots, pas plus, pas moins", ou un pigiste engagé pour une longueur d'article spécifique, a besoin d'un nombre exact plutôt que d'une vague impression d'être "à peu près correct". Taper directement dans l'éditeur et regarder le décompte en direct, ou définir un objectif au-dessus de l'éditeur et regarder la barre de progression se remplir, remplace les devinettes par un total courant qui se met à jour à chaque frappe.

Suivre les progrès d'écriture quotidiens

Les écrivains travaillant sur un long manuscrit se fixent souvent un objectif quotidien de mots, cinq cents mots, mille mots, peu importe ce que le projet exige, et collent simplement le brouillon de chaque jour pour confirmer qu'ils l'ont atteint. Le champ cible sur cette page est conçu exactement pour cela : entrez un objectif une fois, et la barre de progression et le pourcentage se mettent à jour automatiquement à mesure que le nombre de mots change.

Rédiger avec une limite stricte de caractères

Toute personne rédigeant une balise de titre SEO, une méta-description ou une légende pour une plateforme avec un plafond de caractères strict a tout intérêt à surveiller le nombre de caractères pendant la rédaction plutôt que d'écrire librement et de couper par la suite. La troncature sur les résultats de recherche et les plateformes sociales coupe généralement au milieu de la phrase avec des points de suspension, donc connaître la limite avant de terminer la phrase produit un résultat plus propre que de réduire après coup.

Estimer l'étendue de la traduction ou de la localisation

Les traducteurs et les équipes de localisation doivent souvent estimer le coût ou l'effort avant de commencer un projet, et les deux varient généralement avec le nombre de mots ou de caractères sources selon la paire de langues. Passer d'abord un document source par le compteur donne un chiffre concret sur lequel faire un devis, plutôt qu'une estimation à vue d'œil de la longueur du document.

Vérifier les limites des champs de formulaire et de base de données

Les développeurs et les éditeurs de contenu remplissant un champ avec une longueur maximale connue, une colonne de description de produit limitée à 500 caractères, un champ de biographie limité à 160, peuvent coller un texte candidat ici pour confirmer qu'il convient avant de le soumettre à un formulaire ou à une API qui pourrait rejeter ou tronquer silencieusement une valeur trop grande.

Questions Fréquentes

Comment compter les mots dans mon texte ?
Collez ou saisissez simplement votre texte dans l'éditeur ci-dessus. Le compteur de mots se met à jour automatiquement en temps réel, affichant instantanément les mots, les caractères, les phrases, les paragraphes et le temps de lecture estimé. Pas besoin de cliquer sur un bouton !
Quelle est la différence entre caractères et caractères sans espaces ?
« Caractères » compte tout y compris les espaces, tandis que « Caractères sans espaces » ne compte que les lettres, chiffres et ponctuation. Certaines plateformes (comme certains systèmes SMS) comptent les caractères différemment, donc les deux métriques sont utiles.
Comment le temps de lecture est-il calculé ?
Le temps de lecture est calculé à 200 mots par minute, qui est la vitesse de lecture moyenne d'un adulte. Pour le temps de parole (présentations, discours), comptez environ 150 mots par minute.
Mon texte est-il stocké ou envoyé sur un serveur ?
Non ! Tout le traitement s'effectue localement dans votre navigateur via JavaScript. Votre texte ne quitte jamais votre appareil - c'est 100 % privé. Nous ne stockons, transmettons ni n'avons accès à rien de ce que vous tapez.
Combien de mots doit contenir un article de blog pour le SEO ?
Les études montrent que le contenu plus long (1 500-2 500 mots) tend à mieux se positionner sur Google. Cependant, la qualité compte plus que la quantité. Un article bien rédigé de 1 000 mots peut surpasser un article de 3 000 mots rempli de contenu superflu. Visez une couverture complète de votre sujet.
Puis-je compter les mots dans un PDF ou un document Word ?
Oui ! Ouvrez simplement votre document, sélectionnez tout le texte (Ctrl+A ou Cmd+A), copiez-le (Ctrl+C ou Cmd+C) et collez-le dans notre éditeur (Ctrl+V ou Cmd+V). Vous pouvez également glisser-déposer des fichiers .txt directement dans l'éditeur.

Outils de Texte Associés

Besoin d'en faire plus avec votre texte ? Essayez ces outils gratuits :

🔒 100 % Privé et Sécurisé

Votre confidentialité est importante. Contrairement à d'autres compteurs de mots qui peuvent envoyer votre texte sur des serveurs, TextSorter traite tout localement dans votre navigateur. Votre texte ne quitte jamais votre appareil - nous ne pouvons pas le voir, le stocker ni y accéder d'aucune manière. Utilisez notre compteur de mots en toute confiance pour des documents sensibles, des travaux confidentiels ou de l'écriture personnelle.