Tekst

Word/Character Frequency Counter

Analiza częstotliwości tekstu: ile razy występuje każde słowo lub znak, posortowane według liczby wystąpień.


                        
                    

This tool counts how many times each word or character appears in a text and sorts the result by count — something that's practically impossible to tally by hand in a long piece of text.

How to use it

Common uses

Things to keep in mind

Frequency analysis is case-sensitive by default in many implementations — "Word" and "word" can count as different entries unless the text is normalized to one case first.

Classical substitution ciphers (ROT13, the Caesar cipher) don't change the frequency distribution of letters, only the mapping — which is exactly why frequency analysis is the classic way to break them without trying every key.

Artykuł o tym narzędziu: Analiza częstotliwości tekstu: po co liczyć powtórzenia słów

Najczęstsze pytania

Jaka jest różnica między trybem Słowa a Znaki?

Tryb Słowa liczy, ile razy każde słowo pojawia się w tekście, natomiast tryb Znaki liczy wystąpienia każdego pojedynczego znaku, w tym znaków interpunkcyjnych.

Co robią opcje "Bez rozróżniania wielkości liter" i "Ignoruj spacje"?

"Bez rozróżniania wielkości liter" łączy wystąpienia różniące się tylko wielkością liter, a "Ignoruj spacje" wyklucza spacje z liczenia w trybie znaków; wyniki są następnie sortowane według malejącej liczby wystąpień.

Czy analizowany tekst jest wysyłany na serwer?

Nie, analiza częstotliwości działa całkowicie w Twojej przeglądarce w JavaScript — nic nie jest przesyłane online.

Czym jest prawo Zipfa?

W językach naturalnych częstotliwość słowa jest odwrotnie proporcjonalna do jego rangi pod względem częstotliwości: najczęstsze słowo pojawia się mniej więcej dwa razy częściej niż drugie, trzy razy częściej niż trzecie itd. Znaczące odchylenie od tej prawidłowości to sygnał, że tekst może być sztucznie wygenerowany lub spamerski pod względem słów kluczowych.

Czy analizę częstotliwości można wykorzystać do złamania prostego szyfru?

Tak, w przypadku klasycznych szyfrów podstawieniowych (jak ROT13 czy szyfr Cezara), które nie zmieniają rozkładu częstotliwości liter, a jedynie przestawiają odpowiedniość. Porównując rozkład częstotliwości zaszyfrowanego tekstu ze znanym rozkładem języka oryginału, można odtworzyć odpowiedniość znaków bez przeszukiwania wszystkich kluczy.

Artykuły: Tekst

Case Converter: po co istnieją różne style nazewnictwa

Dlaczego w jednym projekcie zmienne zapisuje się camelCase, a pliki kebab-case, i skąd wzięły się te zasady.

Text Diff: jak algorytmy znajdują różnicę między dwoma tekstami

Jak algorytm diff znajduje minimalny zestaw zmian między dwiema wersjami tekstu.

Wyrażenia regularne: podstawowa składnia i typowe wzorce

Jak czytać wyrażenie regularne i czym dopasowanie zachłanne różni się od leniwego.

Sortowanie i usuwanie duplikatów wierszy: do czego się przydaje

Dlaczego sortowanie numeryczne stawiające „10" przed „9" jest błędem, i jak tego uniknąć.

String Escape: dlaczego ten sam tekst trzeba escapować inaczej

Dlaczego ten sam cudzysłów jest escapowany inaczej w ciągu JS, w JSON i w poleceniu shell.

CRLF kontra LF: dlaczego znaki końca linii wciąż mają znaczenie

Dlaczego plik napisany w Windows może wyglądać jako „cały zmieniony" w gicie na Linuksie.

Liczenie znaków i słów: dlaczego to nie zawsze jest trywialne

Dlaczego emoji lub litera z akcentem może liczyć się jako kilka znaków naraz.

Lorem Ipsum: skąd wziął się tekst zastępczy i po co jest potrzebny

Dlaczego projektanci celowo używają „bezsensownego" tekstu zamiast prawdziwej treści w makietach.

Slugify: jak zamienić dowolny tekst w adres URL

Jak tytuł „Witaj, Świecie! Jak się masz?" zamienia się w kompatybilny z URL ciąg witaj-swiecie-jak-sie-masz.

Markdown: dlaczego prosta składnia tekstowa pokonała rozbudowane edytory

Dlaczego programiści wolą pisać dokumentację w Markdown niż w edytorze tekstu sformatowanego.

Spacje i niewidoczne znaki: ukryta przyczyna dziwnych błędów

Dlaczego dwa pozornie identyczne ciągi znaków mogą się nie zgadzać przez niewidoczny znak.

Text Reverse: dlaczego „odwrócenie tekstu" jest trudniejsze, niż się wydaje

Dlaczego naiwne odwrócenie ciągu znaków może zamienić emoji w nieużyteczne bajty.