ข้อความ
Word/Character Frequency Counter
วิเคราะห์ความถี่ของข้อความ: แต่ละคำหรืออักขระปรากฏกี่ครั้ง เรียงตามจำนวน
This tool counts how many times each word or character appears in a text and sorts the result by count — something that's practically impossible to tally by hand in a long piece of text.
How to use it
- Choose what to analyze — words or individual characters.
- Paste text and a frequency table appears instantly, sorted from most to least common.
- Handy for instantly spotting the most common word or character in a large block of text.
Common uses
- Finding keywords in an article or document for a basic SEO check without dedicated tools.
- A teaching example of frequency analysis when learning cryptography basics or natural language processing.
- Checking a text for excessive repetition of certain words before publishing.
Things to keep in mind
Frequency analysis is case-sensitive by default in many implementations — "Word" and "word" can count as different entries unless the text is normalized to one case first.
Classical substitution ciphers (ROT13, the Caesar cipher) don't change the frequency distribution of letters, only the mapping — which is exactly why frequency analysis is the classic way to break them without trying every key.
บทความเกี่ยวกับเครื่องมือนี้: การวิเคราะห์ความถี่ข้อความ: จาก word cloud สู่การถอดรหัส
คำถามที่พบบ่อย
โหมดคำและอักขระต่างกันอย่างไร?
โหมดคำนับจำนวนครั้งที่แต่ละคำปรากฏในข้อความ ส่วนโหมดอักขระนับการปรากฏของอักขระแต่ละตัว รวมถึงเครื่องหมายวรรคตอน
ตัวเลือก "ไม่สนใจตัวพิมพ์ใหญ่-เล็ก" และ "ไม่นับช่องว่าง" ทำอะไร?
"ไม่สนใจตัวพิมพ์ใหญ่-เล็ก" รวมการปรากฏที่ต่างกันเฉพาะตัวพิมพ์ใหญ่-เล็กเข้าด้วยกัน และ "ไม่นับช่องว่าง" ไม่รวมช่องว่างในการนับสำหรับโหมดอักขระ; ผลลัพธ์จะถูกเรียงตามจำนวนการปรากฏจากมากไปน้อย
ข้อความที่วิเคราะห์ถูกส่งไปยังเซิร์ฟเวอร์หรือไม่?
ไม่ การวิเคราะห์ความถี่ทำงานทั้งหมดในเบราว์เซอร์ของคุณด้วย JavaScript — ไม่มีอะไรถูกส่งออนไลน์
กฎของ Zipf คืออะไร?
ในภาษาธรรมชาติ ความถี่ของคำแปรผกผันกับอันดับความถี่ของคำนั้น: คำที่พบบ่อยที่สุดปรากฏบ่อยประมาณสองเท่าของคำอันดับสอง สามเท่าของคำอันดับสาม เป็นต้น ความเบี่ยงเบนอย่างมีนัยสำคัญจากรูปแบบนี้เป็นสัญญาณว่าข้อความอาจถูกสร้างขึ้นโดยเทียมหรือเป็นสแปมที่ยัดคำสำคัญ
สามารถใช้การวิเคราะห์ความถี่เพื่อถอดรหัสการเข้ารหัสแบบง่ายได้หรือไม่?
ได้ สำหรับรหัสแทนที่แบบคลาสสิก (เช่น ROT13 หรือรหัสของ Caesar) ซึ่งไม่เปลี่ยนการกระจายความถี่ของตัวอักษร แต่เพียงสลับความสอดคล้องกัน การเปรียบเทียบการกระจายความถี่ของข้อความที่เข้ารหัสกับการกระจายที่รู้จักของภาษาต้นฉบับ ทำให้สามารถกู้คืนความสอดคล้องของอักขระได้โดยไม่ต้องลองรหัสทุกแบบ