Texto
Word/Character Frequency Counter
Análise de frequência de texto: quantas vezes cada palavra ou caractere aparece, ordenado por quantidade.
This tool counts how many times each word or character appears in a text and sorts the result by count — something that's practically impossible to tally by hand in a long piece of text.
How to use it
- Choose what to analyze — words or individual characters.
- Paste text and a frequency table appears instantly, sorted from most to least common.
- Handy for instantly spotting the most common word or character in a large block of text.
Common uses
- Finding keywords in an article or document for a basic SEO check without dedicated tools.
- A teaching example of frequency analysis when learning cryptography basics or natural language processing.
- Checking a text for excessive repetition of certain words before publishing.
Things to keep in mind
Frequency analysis is case-sensitive by default in many implementations — "Word" and "word" can count as different entries unless the text is normalized to one case first.
Classical substitution ciphers (ROT13, the Caesar cipher) don't change the frequency distribution of letters, only the mapping — which is exactly why frequency analysis is the classic way to break them without trying every key.
Perguntas frequentes
Qual a diferença entre o modo Palavras e Caracteres?
O modo Palavras conta quantas vezes cada palavra aparece no texto, enquanto o modo Caracteres conta a ocorrência de cada caractere individual, incluindo pontuação.
O que fazem as opções "Sem distinção de maiúsculas" e "Ignorar espaços"?
"Sem distinção de maiúsculas" mescla ocorrências que diferem apenas por maiúscula/minúscula, e "Ignorar espaços" exclui espaços da contagem no modo de caractere; os resultados são então ordenados por contagem decrescente de ocorrências.
O texto analisado é enviado a um servidor?
Não, a análise de frequência é executada inteiramente no seu navegador em JavaScript — nada é transmitido online.
O que é a lei de Zipf?
Nos idiomas naturais, a frequência de uma palavra é inversamente proporcional à sua posição num ranking de frequência: a palavra mais frequente aparece cerca do dobro da segunda mais frequente, o triplo da terceira, e assim por diante. Um desvio significativo desse padrão é um sinal de que o texto pode ter sido gerado artificialmente ou ser spam de palavras-chave.
É possível usar a análise de frequência para quebrar uma cifra simples?
Sim, para cifras de substituição clássicas (como ROT13 ou a cifra de César), que não alteram a distribuição de frequência das letras, apenas reorganizam a correspondência. Comparando a distribuição de frequência do texto cifrado com a distribuição conhecida do idioma original, é possível recuperar a correspondência de caracteres sem testar todas as chaves.