Văn bản
Word/Character Frequency Counter
Phân tích tần suất văn bản: mỗi từ hoặc ký tự xuất hiện bao nhiêu lần, sắp xếp theo số lượng.
This tool counts how many times each word or character appears in a text and sorts the result by count — something that's practically impossible to tally by hand in a long piece of text.
How to use it
- Choose what to analyze — words or individual characters.
- Paste text and a frequency table appears instantly, sorted from most to least common.
- Handy for instantly spotting the most common word or character in a large block of text.
Common uses
- Finding keywords in an article or document for a basic SEO check without dedicated tools.
- A teaching example of frequency analysis when learning cryptography basics or natural language processing.
- Checking a text for excessive repetition of certain words before publishing.
Things to keep in mind
Frequency analysis is case-sensitive by default in many implementations — "Word" and "word" can count as different entries unless the text is normalized to one case first.
Classical substitution ciphers (ROT13, the Caesar cipher) don't change the frequency distribution of letters, only the mapping — which is exactly why frequency analysis is the classic way to break them without trying every key.
Bài viết về công cụ này: Phân tích tần suất văn bản: vì sao cần đếm số lần từ lặp lại
Câu hỏi thường gặp
Sự khác biệt giữa chế độ Từ và Ký tự là gì?
Chế độ Từ đếm số lần mỗi từ xuất hiện trong văn bản, trong khi chế độ Ký tự đếm số lần xuất hiện của từng ký tự riêng lẻ, bao gồm cả dấu câu.
Tùy chọn "Không phân biệt chữ hoa/thường" và "Bỏ qua khoảng trắng" làm gì?
"Không phân biệt chữ hoa/thường" gộp các lần xuất hiện chỉ khác nhau về chữ hoa/thường, và "Bỏ qua khoảng trắng" loại trừ khoảng trắng khỏi việc đếm trong chế độ ký tự; kết quả sau đó được sắp xếp theo số lần xuất hiện giảm dần.
Văn bản được phân tích có được gửi đến máy chủ không?
Không, phân tích tần suất chạy hoàn toàn trong trình duyệt của bạn bằng JavaScript — không có gì được truyền trực tuyến.
Định luật Zipf là gì?
Trong các ngôn ngữ tự nhiên, tần suất của một từ tỷ lệ nghịch với thứ hạng của nó theo tần suất: từ phổ biến nhất xuất hiện gần gấp đôi từ phổ biến thứ hai, gấp ba từ phổ biến thứ ba, v.v. Độ lệch đáng kể so với quy luật này là tín hiệu cho thấy văn bản có thể được tạo ra một cách nhân tạo hoặc bị nhồi nhét từ khóa.
Có thể dùng phân tích tần suất để phá một mật mã đơn giản không?
Có, đối với các mật mã thay thế cổ điển (như ROT13 hay mật mã Caesar) không thay đổi phân bố tần suất chữ cái, mà chỉ sắp xếp lại sự tương ứng. So sánh phân bố tần suất của văn bản mã hóa với phân bố đã biết của ngôn ngữ gốc cho phép khôi phục ánh xạ ký tự mà không cần thử mọi khóa.