텍스트

Word/Character Frequency Counter

텍스트 빈도 분석: 각 단어나 문자가 몇 번 나타나는지 횟수순으로 정렬하여 표시.


                        
                    

This tool counts how many times each word or character appears in a text and sorts the result by count — something that's practically impossible to tally by hand in a long piece of text.

How to use it

Common uses

Things to keep in mind

Frequency analysis is case-sensitive by default in many implementations — "Word" and "word" can count as different entries unless the text is normalized to one case first.

Classical substitution ciphers (ROT13, the Caesar cipher) don't change the frequency distribution of letters, only the mapping — which is exactly why frequency analysis is the classic way to break them without trying every key.

이 도구에 대한 아티클: 텍스트 빈도 분석: 워드 클라우드부터 암호 해독까지

자주 묻는 질문

단어 모드와 문자 모드의 차이는 무엇인가요?

단어 모드는 텍스트에서 각 단어가 나타나는 횟수를 세고, 문자 모드는 구두점을 포함한 각 개별 문자의 출현 횟수를 셉니다.

"대소문자 구분 안 함"과 "공백 무시" 옵션은 무엇을 하나요?

"대소문자 구분 안 함"은 대소문자만 다른 항목을 합치고, "공백 무시"는 문자 모드에서 공백을 계산에서 제외합니다. 결과는 출현 횟수 내림차순으로 정렬됩니다.

분석된 텍스트가 서버로 전송되나요?

아니요, 빈도 분석은 브라우저에서 JavaScript로 완전히 실행되며 — 온라인으로 전송되는 것은 없습니다.

지프의 법칙이란 무엇인가요?

자연어에서 단어의 빈도는 빈도순 순위에 반비례합니다: 가장 흔한 단어는 두 번째로 흔한 단어보다 대략 두 배, 세 번째로 흔한 단어보다 대략 세 배 더 자주 나타납니다. 이 규칙성에서 크게 벗어난다는 것은 텍스트가 인위적으로 생성되었거나 키워드로 도배되었을 수 있다는 신호입니다.

빈도 분석으로 간단한 암호를 해독할 수 있나요?

네, 문자 빈도 분포를 바꾸지 않고 대응 관계만 재배열하는 고전적인 치환 암호(ROT13이나 시저 암호 등)에 대해서는 가능합니다. 암호화된 텍스트의 빈도 분포를 알려진 원래 언어의 분포와 비교하면, 가능한 모든 키를 시도하지 않고도 문자 매핑을 복원할 수 있습니다.

아티클: 텍스트

camelCase, snake_case, kebab-case: 언제 어떤 스타일을 쓸까

camelCase, snake_case, kebab-case가 왜 존재하며, 각각 보통 어디에 쓰이는지.

Text Diff: 텍스트 차이를 찾는 알고리즘의 작동 원리

diff 알고리즘이 텍스트 두 버전 사이의 최소 변경 집합을 찾는 방법.

정규 표현식: 기초와 탐욕적 매칭의 함정

정규 표현식에서 탐욕적 매칭과 게으른 매칭의 차이, 그리고 실무에서 왜 중요한지.

줄 정렬: 알파벳순과 숫자순은 왜 다를까

알파벳순 정렬이 숫자를 텍스트처럼 다루는 이유와, 숫자 정렬과의 차이.

문자열 이스케이핑: JS, JSON, 셸, 정규식마다 규칙이 다른 이유

모든 곳에 통하는 단 하나의 이스케이핑 규칙이 없는 이유 — JS, JSON, 셸, 정규식 각각 고유한 규칙이 있다.

CRLF와 LF: 줄바꿈 문자가 여전히 문제를 일으키는 이유

CRLF와 LF 차이가 어디서 왔는지, git과 스크립트에서 왜 지금도 문제를 일으키는지.

문자 수와 단어 수 세기: 유니코드가 왜 이것을 복잡하게 만드는가

유니코드에서 시각적으로 하나의 이모지가 여러 코드 포인트로 이루어질 수 있는 이유.

Lorem Ipsum: 이 더미 텍스트는 어디서 왔고 왜 의미가 없을까

Lorem Ipsum 텍스트가 실제로 어디서 왔는지, 실제 텍스트 대신 무의미한 텍스트를 쓰는 이유.

Slugify: 제목이 유효한 URL로 바뀌는 과정

기사 제목이 하이픈으로 구분된 깔끔하고 읽기 쉬운 URL로 바뀌는 과정.

Markdown: 문서화의 표준이 된 이유

HTML과 달리 Markdown이 원본 상태에서도 읽기 쉬운 이유.

보이지 않는 공백: 겉보기에 같은 텍스트 비교가 왜 실패할까

보이지 않는 공백 하나가 겉보기에 같은 두 텍스트의 비교를 실패하게 만드는 방법.

텍스트 뒤집기: 이모지에서 왜 깨질까

단순한 텍스트 뒤집기가 여러 코드 포인트로 이루어진 이모지를 왜 깨뜨리는지.