Văn bản
Character & Word Counter
Thống kê văn bản theo thời gian thực: ký tự (có và không có khoảng trắng), từ, dòng, câu, đoạn văn và kích thước tính bằng byte (UTF-8).
This tool counts characters, words, lines, sentences, and paragraphs in real time as you type or paste text, and also shows the size in bytes under UTF-8 encoding.
What gets counted
- Characters with and without spaces — shown separately so you can check against limits like meta descriptions or tweets.
- Words — split on spaces and the punctuation between them.
- Sentences and paragraphs — split on terminal punctuation (. ! ?) and blank lines, respectively.
- UTF-8 byte size — useful when a limit is measured in bytes rather than characters (non-Latin text and emoji take more than one byte each).
Common uses
- Checking a meta description or title's length before publishing so it fits the search result limit.
- Keeping text within a character limit for an assignment, bio, or product description.
- Getting quick text stats without opening a text editor with a word-count panel.
Things to keep in mind
One visual "character" (like an emoji with a skin-tone modifier or a country flag) can be made of several Unicode code points and count differently depending on the counting method.
Social media and form limits sometimes count bytes or grapheme clusters rather than characters — check against this tool's byte counter if that matters.
Bài viết về công cụ này: Đếm ký tự và từ: vì sao không phải lúc nào cũng đơn giản
Câu hỏi thường gặp
Chính xác những thống kê nào được tính?
Công cụ đếm ký tự có và không có khoảng trắng, từ, dòng, câu, đoạn văn, và kích thước văn bản tính bằng byte mã hóa UTF-8.
Tại sao số byte lại khác với số ký tự?
Trong UTF-8, một ký tự Latin đơn giản chiếm một byte, nhưng một ký tự Kirin, chữ có dấu hoặc emoji có thể chiếm từ hai đến bốn byte, vì vậy văn bản có nhiều ký tự đa byte sẽ có số byte cao hơn đáng kể so với số ký tự.
Văn bản của tôi có được gửi đến máy chủ để phân tích không?
Không, tất cả các phép tính diễn ra theo thời gian thực trong trình duyệt của bạn bằng JavaScript, không có gì được gửi trực tuyến.
Vì sao đếm từ lại không chính xác đối với các ngôn ngữ không có khoảng trắng?
Trong tiếng Trung, tiếng Nhật hay tiếng Thái, các từ theo truyền thống không được phân tách bằng khoảng trắng — ranh giới do ngữ pháp và ngữ cảnh quyết định. Đếm dựa trên khoảng trắng đối với những ngôn ngữ này chỉ cho ra "một từ" cho toàn bộ văn bản, hoặc mất hoàn toàn ý nghĩa — cần một thuật toán phân đoạn riêng.
Vì sao đôi khi một emoji lại được tính là nhiều ký tự?
Emoji có bộ điều chỉnh tông màu da hay cờ quốc gia trong Unicode được cấu thành từ nhiều điểm mã kết hợp thành một cụm grapheme hiển thị duy nhất. Việc đếm ngây thơ theo điểm mã có thể tính một ký tự hiển thị thống nhất như vậy là hai, ba hoặc nhiều hơn.