Texto

Word/Character Frequency Counter

Análise de frequência de texto: quantas vezes cada palavra ou caractere aparece, ordenado por quantidade.


                        
                    

This tool counts how many times each word or character appears in a text and sorts the result by count — something that's practically impossible to tally by hand in a long piece of text.

How to use it

Common uses

Things to keep in mind

Frequency analysis is case-sensitive by default in many implementations — "Word" and "word" can count as different entries unless the text is normalized to one case first.

Classical substitution ciphers (ROT13, the Caesar cipher) don't change the frequency distribution of letters, only the mapping — which is exactly why frequency analysis is the classic way to break them without trying every key.

Artigo sobre esta ferramenta: Análise de frequência de texto: para que serve contar repetições de palavras

Perguntas frequentes

Qual a diferença entre o modo Palavras e Caracteres?

O modo Palavras conta quantas vezes cada palavra aparece no texto, enquanto o modo Caracteres conta a ocorrência de cada caractere individual, incluindo pontuação.

O que fazem as opções "Sem distinção de maiúsculas" e "Ignorar espaços"?

"Sem distinção de maiúsculas" mescla ocorrências que diferem apenas por maiúscula/minúscula, e "Ignorar espaços" exclui espaços da contagem no modo de caractere; os resultados são então ordenados por contagem decrescente de ocorrências.

O texto analisado é enviado a um servidor?

Não, a análise de frequência é executada inteiramente no seu navegador em JavaScript — nada é transmitido online.

O que é a lei de Zipf?

Nos idiomas naturais, a frequência de uma palavra é inversamente proporcional à sua posição num ranking de frequência: a palavra mais frequente aparece cerca do dobro da segunda mais frequente, o triplo da terceira, e assim por diante. Um desvio significativo desse padrão é um sinal de que o texto pode ter sido gerado artificialmente ou ser spam de palavras-chave.

É possível usar a análise de frequência para quebrar uma cifra simples?

Sim, para cifras de substituição clássicas (como ROT13 ou a cifra de César), que não alteram a distribuição de frequência das letras, apenas reorganizam a correspondência. Comparando a distribuição de frequência do texto cifrado com a distribuição conhecida do idioma original, é possível recuperar a correspondência de caracteres sem testar todas as chaves.

Artigos: Texto

Case Converter: por que existem estilos de nomenclatura diferentes

Por que um mesmo projeto escreve variáveis em camelCase mas arquivos em kebab-case, e de onde vêm essas regras.

Text Diff: como os algoritmos encontram a diferença entre dois textos

Como um algoritmo de diff encontra o conjunto mínimo de mudanças entre duas versões de um texto.

Expressões regulares: sintaxe básica e padrões comuns

Como ler uma expressão regular e em que a correspondência gananciosa difere da preguiçosa.

Ordenar e remover linhas duplicadas: para que serve

Por que uma ordenação numérica que coloca "10" antes de "9" é um erro, e como evitá-lo.

String Escape: por que o mesmo texto precisa ser escapado de forma diferente

Por que a mesma aspa é escapada de forma diferente numa string JS, em JSON e num comando shell.

CRLF contra LF: por que os caracteres de fim de linha ainda importam

Por que um arquivo escrito no Windows pode aparecer como "totalmente alterado" no git em Linux.

Contar caracteres e palavras: por que nem sempre é trivial

Por que um emoji ou uma letra acentuada podem contar como vários caracteres de uma vez.

Lorem Ipsum: de onde vem o texto de preenchimento e para que serve

Por que os designers usam deliberadamente texto "sem sentido" em vez de conteúdo real em mockups.

Slugify: como transformar qualquer texto numa URL

Como um título como "Olá, Mundo!" se transforma numa string compatível com URL como ola-mundo.

Markdown: por que uma sintaxe de texto simples venceu editores ricos

Por que desenvolvedores preferem escrever documentação em Markdown em vez de num editor de texto rico.

Espaços e caracteres invisíveis: a causa oculta de bugs estranhos

Por que duas strings aparentemente idênticas podem não coincidir por causa de um caractere invisível.

Text Reverse: por que "inverter um texto" é mais difícil do que parece

Por que uma inversão ingênua de string pode transformar um emoji em bytes inutilizáveis.