テキスト

Word/Character Frequency Counter

テキストの頻度分析:各単語・文字が出現する回数を、回数順にソートして表示。


                        
                    

This tool counts how many times each word or character appears in a text and sorts the result by count — something that's practically impossible to tally by hand in a long piece of text.

How to use it

Common uses

Things to keep in mind

Frequency analysis is case-sensitive by default in many implementations — "Word" and "word" can count as different entries unless the text is normalized to one case first.

Classical substitution ciphers (ROT13, the Caesar cipher) don't change the frequency distribution of letters, only the mapping — which is exactly why frequency analysis is the classic way to break them without trying every key.

このツールに関する記事: テキスト頻度分析:ワードクラウドから暗号解読まで

よくある質問

単語モードと文字モードの違いは何ですか?

単語モードはテキスト内で各単語が何回出現するかを数え、文字モードは句読点を含む各個別文字の出現をカウントします。

「大文字小文字を区別しない」と「スペースを無視」オプションは何をしますか?

「大文字小文字を区別しない」は大文字・小文字のみが異なる出現をマージし、「スペースを無視」は文字モードのカウントからスペースを除外します。結果はその後、出現回数の降順でソートされます。

分析されたテキストはサーバーに送信されますか?

いいえ、頻度分析はブラウザ内で完全にJavaScriptで実行されます — オンラインには何も送信されません。

ジップの法則とは何ですか?

自然言語では、単語の出現頻度は頻度による順位に反比例します — 最も頻繁な単語は2番目のおよそ2倍、3番目のおよそ3倍出現します。この規則性からの大きな逸脱は、テキストが人工的に生成されたものか、キーワードスパムである可能性を示すシグナルです。

頻度分析を使って単純な暗号を解読できますか?

はい、ROT13やシーザー暗号のような古典的な換字式暗号では、文字の頻度分布自体は変わらず、対応関係が入れ替わるだけです。暗号化されたテキストの頻度分布を元の言語の既知の分布と比較すれば、すべての鍵を試すことなく文字の対応関係を復元できます。

記事: テキスト

camelCase、snake_case、kebab-case:どの場面でどれを使うか

なぜcamelCase、snake_case、kebab-caseが存在し、それぞれ普通どこで使われるか。

Text Diff:テキストの差分検出アルゴリズムの仕組み

diffアルゴリズムがテキストの2つのバージョン間の最小変更セットをどう見つけるか。

正規表現:基本と貪欲マッチの罠

正規表現における貪欲マッチと非貪欲マッチの違いと、それが実務でなぜ重要か。

行のソート:アルファベット順と数値順はなぜ違うのか

アルファベット順ソートが数値をテキストとして扱う理由と、数値ソートとの違い。

文字列エスケープ:JS、JSON、シェル、正規表現でルールが異なる理由

あらゆる場面で通用する単一のエスケープルールが存在しない理由 — JS、JSON、シェル、正規表現それぞれに固有のルールがある。

CRLFとLF:改行コードが今も問題を引き起こす理由

CRLFとLFの違いがどこから来たのか、そしてgitやスクリプトで今も問題を引き起こす理由。

文字数と単語数のカウント:Unicodeがなぜこれを複雑にするか

Unicodeにおいて視覚的に1つの絵文字が複数のコードポイントから成り立つことがある理由。

Lorem Ipsum:このダミーテキストはどこから来て、なぜ意味がないのか

Lorem Ipsumテキストが実際どこから来たのか、そして実際のテキストの代わりに無意味なテキストが使われる理由。

Slugify:タイトルが有効なURLに変換される仕組み

記事タイトルがハイフンで区切られたクリーンで読みやすいURLに変換される仕組み。

Markdown:ドキュメント作成の標準になった理由

HTMLとは違い、Markdownが生のままでも読みやすい理由。

見えない空白文字:見た目が同じテキストの比較がなぜ失敗するのか

見えない空白文字1つが、見た目上同じ2つのテキストの比較を失敗させる仕組み。

テキストの反転:絵文字でなぜ壊れるのか

単純なテキスト反転が、複数のコードポイントから成る絵文字をなぜ壊してしまうのか。