텍스트

Character & Word Counter

실시간 텍스트 통계: 문자 수(공백 포함/미포함), 단어 수, 줄 수, 문장 수, 문단 수, 바이트 크기(UTF-8).

0 문자 수(공백 포함)
0 문자 수(공백 미포함)
0 단어 수
0 줄 수
0 문장 수
0 문단 수
0 바이트 수(UTF-8)

This tool counts characters, words, lines, sentences, and paragraphs in real time as you type or paste text, and also shows the size in bytes under UTF-8 encoding.

What gets counted

Common uses

Things to keep in mind

One visual "character" (like an emoji with a skin-tone modifier or a country flag) can be made of several Unicode code points and count differently depending on the counting method.

Social media and form limits sometimes count bytes or grapheme clusters rather than characters — check against this tool's byte counter if that matters.

이 도구에 대한 아티클: 문자 수와 단어 수 세기: 유니코드가 왜 이것을 복잡하게 만드는가

자주 묻는 질문

정확히 무엇을 세어 주나요?

공백 포함·미포함 문자 수, 단어 수, 줄 수, 문장 수, 문단 수, 그리고 UTF-8 기준 바이트 수까지 실시간으로 집계합니다.

문자 수와 바이트 수가 왜 다르게 나오나요?

UTF-8에서는 한글을 비롯한 비-라틴 문자가 문자 하나당 여러 바이트를 차지하기 때문입니다. 예를 들어 한글 한 글자는 보통 3바이트를 차지하므로, 한글 텍스트의 바이트 수는 문자 수보다 훨씬 크게 나타납니다.

입력한 텍스트가 어딘가에 저장되거나 전송되나요?

아니요. 모든 집계는 브라우저 안에서 자바스크립트로 처리되며 텍스트는 서버로 전송되지 않습니다.

공백이 없는 언어에서는 왜 단어 수 세기가 부정확한가요?

중국어, 일본어, 태국어에서는 전통적으로 단어를 공백으로 구분하지 않습니다 — 경계는 문법과 문맥이 정합니다. 이런 언어에서 공백 기준으로 세면 텍스트 전체가 "단어" 하나가 되거나 의미가 사라지므로, 별도의 텍스트 분절 알고리즘이 필요합니다.

이모지 하나가 왜 여러 문자로 세어질 때가 있나요?

피부색 수정자가 있는 이모지나 국기 이모지는 유니코드에서 여러 코드 포인트가 결합되어 하나의 시각적 자소 클러스터를 이룹니다. 코드 포인트 기준의 단순한 카운팅은 이렇게 시각적으로는 하나인 문자를 둘, 셋, 또는 그 이상으로 셀 수 있습니다.

아티클: 텍스트

camelCase, snake_case, kebab-case: 언제 어떤 스타일을 쓸까

camelCase, snake_case, kebab-case가 왜 존재하며, 각각 보통 어디에 쓰이는지.

Text Diff: 텍스트 차이를 찾는 알고리즘의 작동 원리

diff 알고리즘이 텍스트 두 버전 사이의 최소 변경 집합을 찾는 방법.

정규 표현식: 기초와 탐욕적 매칭의 함정

정규 표현식에서 탐욕적 매칭과 게으른 매칭의 차이, 그리고 실무에서 왜 중요한지.

줄 정렬: 알파벳순과 숫자순은 왜 다를까

알파벳순 정렬이 숫자를 텍스트처럼 다루는 이유와, 숫자 정렬과의 차이.

문자열 이스케이핑: JS, JSON, 셸, 정규식마다 규칙이 다른 이유

모든 곳에 통하는 단 하나의 이스케이핑 규칙이 없는 이유 — JS, JSON, 셸, 정규식 각각 고유한 규칙이 있다.

CRLF와 LF: 줄바꿈 문자가 여전히 문제를 일으키는 이유

CRLF와 LF 차이가 어디서 왔는지, git과 스크립트에서 왜 지금도 문제를 일으키는지.

Lorem Ipsum: 이 더미 텍스트는 어디서 왔고 왜 의미가 없을까

Lorem Ipsum 텍스트가 실제로 어디서 왔는지, 실제 텍스트 대신 무의미한 텍스트를 쓰는 이유.

Slugify: 제목이 유효한 URL로 바뀌는 과정

기사 제목이 하이픈으로 구분된 깔끔하고 읽기 쉬운 URL로 바뀌는 과정.

Markdown: 문서화의 표준이 된 이유

HTML과 달리 Markdown이 원본 상태에서도 읽기 쉬운 이유.

보이지 않는 공백: 겉보기에 같은 텍스트 비교가 왜 실패할까

보이지 않는 공백 하나가 겉보기에 같은 두 텍스트의 비교를 실패하게 만드는 방법.

텍스트 뒤집기: 이모지에서 왜 깨질까

단순한 텍스트 뒤집기가 여러 코드 포인트로 이루어진 이모지를 왜 깨뜨리는지.

텍스트 빈도 분석: 워드 클라우드부터 암호 해독까지

문자 빈도 분석이 역사적으로 단순 치환 암호를 해독하는 데 어떻게 도움이 되었는지.