Teks

Sort & Dedupe Lines

Mengurutkan baris teks secara alfabet, menghapus duplikat, baris kosong, dan spasi berlebih.

This tool sorts a list of lines alphabetically and removes duplicates and blank lines — a routine cleanup that's slow and error-prone to do by hand.

How to use it

Common uses

Things to keep in mind

Plain alphabetical sorting puts "file10" before "file2", since it compares strings character by character — natural sort is needed for the expected order with numbers.

Duplicate removal is case-sensitive by default — "Text" and "text" count as different lines unless the text is normalized to one case first.

Artikel tentang alat ini: Mengurutkan dan menghapus duplikat baris: untuk apa gunanya

Pertanyaan yang sering diajukan

Apa perbedaan antara pengurutan peka huruf besar/kecil dan tidak peka?

Dengan "Tidak peka huruf besar/kecil" nonaktif, huruf besar dan kecil diurutkan terpisah berdasarkan kode karakter; diaktifkan, ia membandingkan baris tanpa memandang huruf besar/kecil, mendekatkan "Apel" dan "apel".

Bagaimana duplikat, baris kosong, dan spasi ditangani?

Dua baris identik (menurut opsi huruf besar/kecil yang dipilih) dianggap duplikat dan hanya yang pertama disimpan; "Pangkas spasi" menghapus spasi di awal dan akhir sebelum pengurutan, dan "Hapus baris kosong" menghilangkan baris tanpa karakter yang terlihat.

Apakah baris teks saya dikirim ke server?

Tidak, pengurutan dan deduplikasi terjadi sepenuhnya di browser Anda dalam JavaScript — tidak ada data yang dikirim ke tempat lain.

Mengapa "10" berada sebelum "9" pada pengurutan alfabet?

Pengurutan alfabet (leksikografis) membandingkan string karakter demi karakter sebagai teks, bukan sebagai angka: "1" secara leksikografis lebih kecil dari "9", sehingga "10" berada sebelum "9". Untuk urutan numerik, string perlu diurai sebagai angka terlebih dahulu.

Apakah bisa mengurutkan dengan urutan alami (natural sort)?

Pengurutan alami mengenali rangkaian angka di dalam string sebagai angka, sementara sisanya dibandingkan sebagai teks — berkat ini "file2.txt" berada sebelum "file10.txt", yang berguna untuk nama berkas atau versi dengan prefiks teks.

Artikel: Teks

Case Converter: mengapa ada gaya penamaan yang berbeda

Mengapa dalam satu proyek variabel ditulis camelCase tapi berkas kebab-case, dan dari mana aturan ini berasal.

Text Diff: bagaimana algoritma menemukan perbedaan antara dua teks

Bagaimana algoritma diff menemukan kumpulan perubahan minimal antara dua versi teks.

Ekspresi reguler: sintaks dasar dan pola umum

Cara membaca ekspresi reguler, dan bagaimana pencocokan greedy berbeda dari lazy.

String Escape: mengapa teks yang sama perlu di-escape secara berbeda

Mengapa tanda kutip yang sama di-escape secara berbeda dalam string JS, JSON, dan perintah shell.

CRLF vs LF: mengapa karakter akhir baris masih penting

Mengapa berkas yang ditulis di Windows bisa terlihat "seluruhnya berubah" di git pada Linux.

Menghitung karakter dan kata: mengapa tidak selalu sepele

Mengapa emoji atau huruf beraksen bisa terhitung sebagai beberapa karakter sekaligus.

Lorem Ipsum: dari mana teks pengganti ini berasal dan untuk apa

Mengapa desainer sengaja menggunakan teks "tanpa arti" alih-alih konten sungguhan dalam mockup.

Slugify: mengubah teks apa pun menjadi URL

Bagaimana judul seperti "Halo, Dunia! Apa kabar?" menjadi string kompatibel URL seperti halo-dunia-apa-kabar.

Markdown: mengapa sintaks teks sederhana mengalahkan editor teks kaya

Mengapa developer memilih menulis dokumentasi dalam Markdown alih-alih editor teks kaya.

Spasi dan karakter tak terlihat: penyebab tersembunyi bug aneh

Mengapa dua string yang terlihat identik bisa tidak cocok karena karakter tak terlihat.

Text Reverse: mengapa "membalik teks" lebih sulit dari kelihatannya

Mengapa pembalikan string yang naif bisa mengubah emoji menjadi byte yang tidak dapat digunakan.

Analisis frekuensi teks: untuk apa menghitung pengulangan kata

Bagaimana frekuensi huruf dalam teks terenkripsi membantu memecahkan sandi substitusi paling sederhana.