Texte

Word/Character Frequency Counter

Analyse de fréquence du texte : combien de fois chaque mot ou caractère apparaît, trié par nombre.


                        
                    

This tool counts how many times each word or character appears in a text and sorts the result by count — something that's practically impossible to tally by hand in a long piece of text.

How to use it

Common uses

Things to keep in mind

Frequency analysis is case-sensitive by default in many implementations — "Word" and "word" can count as different entries unless the text is normalized to one case first.

Classical substitution ciphers (ROT13, the Caesar cipher) don't change the frequency distribution of letters, only the mapping — which is exactly why frequency analysis is the classic way to break them without trying every key.

Article sur cet outil: Analyse de fréquence de texte : pourquoi compter les répétitions de mots

Questions fréquentes

Quelle est la différence entre les modes Mots et Caractères ?

Le mode Mots compte combien de fois chaque mot apparaît dans le texte, tandis que le mode Caractères compte l'occurrence de chaque caractère individuel, y compris la ponctuation.

À quoi servent les options « Insensible à la casse » et « Ignorer les espaces » ?

L'option « Insensible à la casse » fusionne les occurrences qui ne diffèrent que par la majuscule/minuscule, et « Ignorer les espaces » exclut les espaces du comptage en mode caractères ; les résultats sont ensuite triés par nombre d'occurrences décroissant.

Le texte analysé est-il envoyé à un serveur ?

Non, l'analyse de fréquence se fait entièrement dans votre navigateur en JavaScript, rien n'est transmis en ligne.

Qu'est-ce que la loi de Zipf ?

Dans les langues naturelles, la fréquence d'un mot est inversement proportionnelle à son rang de fréquence : le mot le plus fréquent apparaît environ deux fois plus souvent que le deuxième, trois fois plus souvent que le troisième, et ainsi de suite. Un écart important par rapport à cette régularité est un signal que le texte peut être généré artificiellement ou spammé par mots-clés.

Peut-on utiliser l'analyse de fréquence pour casser un chiffrement simple ?

Oui, pour les chiffrements de substitution classiques (comme ROT13 ou le chiffre de César), qui ne modifient pas la répartition des fréquences des lettres mais se contentent d'en changer la correspondance. En comparant la répartition des fréquences du texte chiffré à la répartition connue de la langue d'origine, on peut reconstituer la correspondance des caractères sans tester toutes les clés.

Articles : Texte

Case Converter : pourquoi il existe différents styles de nommage

Pourquoi un même projet écrit les variables en camelCase mais les fichiers en kebab-case, et d'où viennent ces règles.

Text Diff : comment les algorithmes trouvent la différence entre deux textes

Comment un algorithme de diff trouve l'ensemble minimal de changements entre deux versions d'un texte.

Expressions régulières : syntaxe de base et motifs courants

Comment lire une expression régulière, et en quoi la correspondance gourmande diffère de la paresseuse.

Trier et dédupliquer des lignes : pourquoi c'est utile

Pourquoi un tri numérique plaçant « 10 » avant « 9 » est une erreur, et comment l'éviter.

String Escape : pourquoi le même texte doit être échappé différemment

Pourquoi le même guillemet s'échappe différemment dans une chaîne JS, du JSON et une commande shell.

CRLF contre LF : pourquoi les caractères de fin de ligne comptent encore

Pourquoi un fichier écrit sous Windows peut apparaître « entièrement modifié » dans git sous Linux.

Compter les caractères et les mots : pourquoi ce n'est pas toujours trivial

Pourquoi un emoji ou une lettre accentuée peut compter comme plusieurs caractères à la fois.

Lorem Ipsum : d'où vient ce texte de remplissage et à quoi il sert

Pourquoi les designers utilisent délibérément un texte « insensé » plutôt que du vrai contenu dans les maquettes.

Slugify : transformer un texte quelconque en URL

Comment un titre comme « Bonjour, le Monde ! » devient une chaîne compatible URL comme bonjour-le-monde.

Markdown : pourquoi une syntaxe texte simple a supplanté les éditeurs riches

Pourquoi les développeurs préfèrent écrire la documentation en Markdown plutôt que dans un éditeur de texte riche.

Espaces et caractères invisibles : la cause cachée de bugs étranges

Pourquoi deux chaînes qui semblent identiques peuvent ne pas correspondre à cause d'un caractère invisible.

Text Reverse : pourquoi « inverser un texte » est plus dur qu'il n'y paraît

Pourquoi une inversion naïve de chaîne peut transformer un emoji en octets inutilisables.