텍스트

Sort & Dedupe Lines

텍스트 줄을 알파벳순으로 정렬하고, 중복 줄, 빈 줄, 불필요한 공백을 제거.

This tool sorts a list of lines alphabetically and removes duplicates and blank lines — a routine cleanup that's slow and error-prone to do by hand.

How to use it

Common uses

Things to keep in mind

Plain alphabetical sorting puts "file10" before "file2", since it compares strings character by character — natural sort is needed for the expected order with numbers.

Duplicate removal is case-sensitive by default — "Text" and "text" count as different lines unless the text is normalized to one case first.

이 도구에 대한 아티클: 줄 정렬: 알파벳순과 숫자순은 왜 다를까

자주 묻는 질문

대소문자를 구분해서 정렬할 수 있나요?

옵션으로 대소문자 구분 정렬과 대소문자 구분 안 함 정렬 중 선택할 수 있습니다. 구분 안 함을 선택하면 "Apple"과 "apple"이 같은 기준으로 비교됩니다.

중복 줄은 어떤 기준으로 제거되나요?

중복 제거 옵션을 켜면 완전히 동일한 줄(대소문자 구분 안 함 옵션이 켜져 있으면 대소문자 차이도 무시)만 남기고 나머지는 제거되며, 공백 다듬기와 빈 줄 제거 옵션도 함께 적용할 수 있습니다.

입력한 목록이 어딘가로 전송되나요?

아니요. 정렬과 중복 제거는 브라우저 안에서 자바스크립트로 처리되며 서버로는 아무것도 전송되지 않습니다.

알파벳순 정렬에서 왜 "10"이 "9"보다 앞에 오나요?

알파벳순(사전식) 정렬은 문자열을 숫자가 아니라 텍스트로 취급해 문자 하나하나 비교합니다: "1"이 사전순으로 "9"보다 작기 때문에 "10"이 "9"보다 앞에 옵니다. 숫자 순서를 원한다면 먼저 문자열을 숫자로 파싱해야 합니다.

자연 정렬(natural sort)로 정렬할 수 있나요?

자연 정렬은 문자열 안의 연속된 숫자를 숫자로 인식하고 나머지는 텍스트로 비교합니다. 그 덕분에 "file2.txt"가 "file10.txt"보다 앞에 오며, 텍스트 접두사가 붙은 파일명이나 버전명을 정렬할 때 유용합니다.

아티클: 텍스트

camelCase, snake_case, kebab-case: 언제 어떤 스타일을 쓸까

camelCase, snake_case, kebab-case가 왜 존재하며, 각각 보통 어디에 쓰이는지.

Text Diff: 텍스트 차이를 찾는 알고리즘의 작동 원리

diff 알고리즘이 텍스트 두 버전 사이의 최소 변경 집합을 찾는 방법.

정규 표현식: 기초와 탐욕적 매칭의 함정

정규 표현식에서 탐욕적 매칭과 게으른 매칭의 차이, 그리고 실무에서 왜 중요한지.

문자열 이스케이핑: JS, JSON, 셸, 정규식마다 규칙이 다른 이유

모든 곳에 통하는 단 하나의 이스케이핑 규칙이 없는 이유 — JS, JSON, 셸, 정규식 각각 고유한 규칙이 있다.

CRLF와 LF: 줄바꿈 문자가 여전히 문제를 일으키는 이유

CRLF와 LF 차이가 어디서 왔는지, git과 스크립트에서 왜 지금도 문제를 일으키는지.

문자 수와 단어 수 세기: 유니코드가 왜 이것을 복잡하게 만드는가

유니코드에서 시각적으로 하나의 이모지가 여러 코드 포인트로 이루어질 수 있는 이유.

Lorem Ipsum: 이 더미 텍스트는 어디서 왔고 왜 의미가 없을까

Lorem Ipsum 텍스트가 실제로 어디서 왔는지, 실제 텍스트 대신 무의미한 텍스트를 쓰는 이유.

Slugify: 제목이 유효한 URL로 바뀌는 과정

기사 제목이 하이픈으로 구분된 깔끔하고 읽기 쉬운 URL로 바뀌는 과정.

Markdown: 문서화의 표준이 된 이유

HTML과 달리 Markdown이 원본 상태에서도 읽기 쉬운 이유.

보이지 않는 공백: 겉보기에 같은 텍스트 비교가 왜 실패할까

보이지 않는 공백 하나가 겉보기에 같은 두 텍스트의 비교를 실패하게 만드는 방법.

텍스트 뒤집기: 이모지에서 왜 깨질까

단순한 텍스트 뒤집기가 여러 코드 포인트로 이루어진 이모지를 왜 깨뜨리는지.

텍스트 빈도 분석: 워드 클라우드부터 암호 해독까지

문자 빈도 분석이 역사적으로 단순 치환 암호를 해독하는 데 어떻게 도움이 되었는지.