テキスト

Character & Word Counter

リアルタイムのテキスト統計:文字数(スペース込み・なし)、単語数、行数、文の数、段落数、バイト数(UTF-8)。

0 文字数(スペース込み)
0 文字数(スペースなし)
0 単語数
0 行数
0 文の数
0 段落数
0 バイト数(UTF-8)

This tool counts characters, words, lines, sentences, and paragraphs in real time as you type or paste text, and also shows the size in bytes under UTF-8 encoding.

What gets counted

Common uses

Things to keep in mind

One visual "character" (like an emoji with a skin-tone modifier or a country flag) can be made of several Unicode code points and count differently depending on the counting method.

Social media and form limits sometimes count bytes or grapheme clusters rather than characters — check against this tool's byte counter if that matters.

このツールに関する記事: 文字数と単語数のカウント:Unicodeがなぜこれを複雑にするか

よくある質問

正確にはどのような統計が計算されますか?

このツールはスペースあり・なしの文字数、単語数、行数、文数、段落数、およびUTF-8エンコードされたバイト単位のテキストサイズをカウントします。

なぜバイト数は文字数と異なるのですか?

UTF-8では、単純なラテン文字は1バイトを占めますが、キリル文字、アクセント付き文字、絵文字は2〜4バイトを占めることがあるため、多くのマルチバイト文字を含むテキストは文字数よりもかなり多いバイト数になります。

私のテキストは分析のためにサーバーに送信されますか?

いいえ、すべての計算はブラウザ内でJavaScriptによりリアルタイムで行われ、オンラインには何も送信されません。

なぜスペースのない言語では単語数カウントが不正確なのですか?

中国語、日本語、タイ語では、単語は伝統的にスペースで区切られません — 境界を決めるのは文法と文脈です。こうした言語をスペースで区切って数えると、テキスト全体が1つの「単語」になるか、意味をなさなくなります。専用の分かち書きアルゴリズムが必要です。

なぜ1つの絵文字が複数の文字として数えられることがあるのですか?

肌の色の修飾子や国旗を持つ絵文字は、Unicodeでは1つの視覚的な書記素クラスタに結合される複数のコードポイントから構成されています。コードポイント単位の単純なカウントでは、視覚的には1つのこうした文字を2つ、3つ、あるいはそれ以上として数えてしまうことがあります。

記事: テキスト

camelCase、snake_case、kebab-case:どの場面でどれを使うか

なぜcamelCase、snake_case、kebab-caseが存在し、それぞれ普通どこで使われるか。

Text Diff:テキストの差分検出アルゴリズムの仕組み

diffアルゴリズムがテキストの2つのバージョン間の最小変更セットをどう見つけるか。

正規表現:基本と貪欲マッチの罠

正規表現における貪欲マッチと非貪欲マッチの違いと、それが実務でなぜ重要か。

行のソート:アルファベット順と数値順はなぜ違うのか

アルファベット順ソートが数値をテキストとして扱う理由と、数値ソートとの違い。

文字列エスケープ:JS、JSON、シェル、正規表現でルールが異なる理由

あらゆる場面で通用する単一のエスケープルールが存在しない理由 — JS、JSON、シェル、正規表現それぞれに固有のルールがある。

CRLFとLF:改行コードが今も問題を引き起こす理由

CRLFとLFの違いがどこから来たのか、そしてgitやスクリプトで今も問題を引き起こす理由。

Lorem Ipsum:このダミーテキストはどこから来て、なぜ意味がないのか

Lorem Ipsumテキストが実際どこから来たのか、そして実際のテキストの代わりに無意味なテキストが使われる理由。

Slugify:タイトルが有効なURLに変換される仕組み

記事タイトルがハイフンで区切られたクリーンで読みやすいURLに変換される仕組み。

Markdown:ドキュメント作成の標準になった理由

HTMLとは違い、Markdownが生のままでも読みやすい理由。

見えない空白文字:見た目が同じテキストの比較がなぜ失敗するのか

見えない空白文字1つが、見た目上同じ2つのテキストの比較を失敗させる仕組み。

テキストの反転:絵文字でなぜ壊れるのか

単純なテキスト反転が、複数のコードポイントから成る絵文字をなぜ壊してしまうのか。

テキスト頻度分析:ワードクラウドから暗号解読まで

文字頻度分析が歴史的にどう単純な換字式暗号の解読に役立ったか。