Текст

Word/Character Frequency Counter

Частотный анализ текста: сколько раз встречается каждое слово или символ, отсортировано по количеству.


                        
                    

This tool counts how many times each word or character appears in a text and sorts the result by count — something that's practically impossible to tally by hand in a long piece of text.

How to use it

Common uses

Things to keep in mind

Frequency analysis is case-sensitive by default in many implementations — "Word" and "word" can count as different entries unless the text is normalized to one case first.

Classical substitution ciphers (ROT13, the Caesar cipher) don't change the frequency distribution of letters, only the mapping — which is exactly why frequency analysis is the classic way to break them without trying every key.

Статья об этом инструменте: Частотный анализ текста: зачем считать повторения слов

Часто задаваемые вопросы

Чем отличаются режимы «Слова» и «Символы»?

Режим «Слова» считает, сколько раз каждое слово встречается в тексте, тогда как режим «Символы» считает вхождения каждого отдельного символа, включая пунктуацию.

Что делают опции «Без учёта регистра» и «Игнорировать пробелы»?

«Без учёта регистра» объединяет вхождения, отличающиеся только регистром, а «Игнорировать пробелы» исключает пробелы из подсчёта в режиме символов; результаты затем сортируются по убыванию количества вхождений.

Отправляется ли анализируемый текст на сервер?

Нет, анализ частоты полностью выполняется в вашем браузере на JavaScript — ничего не передаётся онлайн.

Что такое закон Ципфа?

В естественных языках частота слова обратно пропорциональна его рангу по частоте: самое частое слово встречается примерно вдвое чаще второго, втрое чаще третьего и так далее. Существенное отклонение от этой закономерности — сигнал, что текст может быть искусственно сгенерирован или заспамлен ключевыми словами.

Можно ли использовать частотный анализ для взлома простого шифра?

Да, для классических шифров подстановки (как ROT13 или шифр Цезаря), которые не меняют распределение частот букв, а лишь переставляют соответствие. Сравнив частотное распределение зашифрованного текста с известным распределением языка оригинала, можно восстановить соответствие символов без перебора всех ключей.

Статьи: Текст

Case Converter: зачем нужны разные стили написания

Почему в одном проекте переменные пишут camelCase, а файлы — kebab-case, и откуда взялись эти правила.

Text Diff: как алгоритмы находят разницу между текстами

Как diff-алгоритм находит минимальный набор изменений между двумя версиями текста.

Регулярные выражения: основной синтаксис и типичные паттерны

Как читать регулярное выражение и чем жадный поиск отличается от ленивого.

Сортировка и удаление дубликатов строк: зачем это нужно

Почему числовая сортировка «10» перед «9» — это ошибка, и как этого избежать.

String Escape: почему один и тот же текст нужно экранировать по-разному

Почему один и тот же символ кавычки экранируется по-разному в JS-строке, JSON и shell-команде.

CRLF против LF: почему символы конца строки до сих пор важны

Почему файл, написанный в Windows, может показывать «изменён весь файл» в git на Linux.

Подсчёт символов и слов: почему это не всегда тривиально

Почему эмодзи или символы с диакритикой могут считаться как несколько символов сразу.

Lorem Ipsum: откуда взялся текст-заполнитель и зачем он нужен

Почему дизайнеры намеренно используют «бессмысленный» текст вместо реального контента в макетах.

Slugify: как превратить произвольный текст в URL-адрес

Как заголовок «Привет, Мир!» превращается в URL-совместимую строку вида privet-mir.

Markdown: почему простой текстовый синтаксис победил сложные редакторы

Почему разработчики выбирают писать документацию в Markdown, а не в форматированном текстовом редакторе.

Пробелы и невидимые символы: скрытая причина странных багов

Почему две на вид одинаковые строки могут не совпадать при сравнении из-за невидимого символа.

Text Reverse: почему «перевернуть текст» сложнее, чем кажется

Почему наивный реверс строки может превратить эмодзи в непригодные для показа байты.