テキスト

Sort & Dedupe Lines

テキストの行をアルファベット順にソートし、重複行・空行・余分な空白を削除。

This tool sorts a list of lines alphabetically and removes duplicates and blank lines — a routine cleanup that's slow and error-prone to do by hand.

How to use it

Common uses

Things to keep in mind

Plain alphabetical sorting puts "file10" before "file2", since it compares strings character by character — natural sort is needed for the expected order with numbers.

Duplicate removal is case-sensitive by default — "Text" and "text" count as different lines unless the text is normalized to one case first.

このツールに関する記事: 行のソート:アルファベット順と数値順はなぜ違うのか

よくある質問

大文字小文字を区別するソートと区別しないソートの違いは何ですか?

「大文字小文字を区別しない」がオフの場合、大文字と小文字は文字コードで別々にソートされます。オンにすると、大文字小文字に関係なく行を比較し、「Apple」と「apple」を近づけます。

重複、空行、空白はどのように処理されますか?

2つの同一行(選択した大文字小文字オプションによる)は重複と見なされ、最初の行のみが保持されます。「空白をトリム」はソート前に行の先頭と末尾のスペースを削除し、「空行を削除」は目に見える文字のない行を排除します。

私のテキスト行はサーバーに送信されますか?

いいえ、ソートと重複排除はブラウザ内で完全にJavaScriptで行われます — データはどこにも送信されません。

なぜアルファベット順ソートでは"10"が"9"より前に来るのですか?

アルファベット順(辞書式)ソートは、文字列を数値としてではなくテキストとして文字ごとに比較します: "1"は辞書順で"9"より小さいため、"10"が"9"より前に来ます。数値順にするには、文字列を先に数値としてパースする必要があります。

自然順ソート(natural sort)で並べ替えることはできますか?

自然順ソートは、文字列内の連続した数字を数値として認識し、それ以外はテキストとして比較します — これにより"file2.txt"は"file10.txt"より前に来て、テキストの接頭辞を持つファイル名やバージョン番号に便利です。

記事: テキスト

camelCase、snake_case、kebab-case:どの場面でどれを使うか

なぜcamelCase、snake_case、kebab-caseが存在し、それぞれ普通どこで使われるか。

Text Diff:テキストの差分検出アルゴリズムの仕組み

diffアルゴリズムがテキストの2つのバージョン間の最小変更セットをどう見つけるか。

正規表現:基本と貪欲マッチの罠

正規表現における貪欲マッチと非貪欲マッチの違いと、それが実務でなぜ重要か。

文字列エスケープ:JS、JSON、シェル、正規表現でルールが異なる理由

あらゆる場面で通用する単一のエスケープルールが存在しない理由 — JS、JSON、シェル、正規表現それぞれに固有のルールがある。

CRLFとLF:改行コードが今も問題を引き起こす理由

CRLFとLFの違いがどこから来たのか、そしてgitやスクリプトで今も問題を引き起こす理由。

文字数と単語数のカウント:Unicodeがなぜこれを複雑にするか

Unicodeにおいて視覚的に1つの絵文字が複数のコードポイントから成り立つことがある理由。

Lorem Ipsum:このダミーテキストはどこから来て、なぜ意味がないのか

Lorem Ipsumテキストが実際どこから来たのか、そして実際のテキストの代わりに無意味なテキストが使われる理由。

Slugify:タイトルが有効なURLに変換される仕組み

記事タイトルがハイフンで区切られたクリーンで読みやすいURLに変換される仕組み。

Markdown:ドキュメント作成の標準になった理由

HTMLとは違い、Markdownが生のままでも読みやすい理由。

見えない空白文字:見た目が同じテキストの比較がなぜ失敗するのか

見えない空白文字1つが、見た目上同じ2つのテキストの比較を失敗させる仕組み。

テキストの反転:絵文字でなぜ壊れるのか

単純なテキスト反転が、複数のコードポイントから成る絵文字をなぜ壊してしまうのか。

テキスト頻度分析:ワードクラウドから暗号解読まで

文字頻度分析が歴史的にどう単純な換字式暗号の解読に役立ったか。