เครื่องนับตัวอักษรและอักขระแบบออนไลน์
นับตัวอักษรและอักขระในข้อความได้ทันที รองรับภาษาไทยและหลายภาษา เลือกไม่นับช่องว่างหรือตัว…
เริ่มใช้งาน
คุณสมบัติและรายละเอียดการใช้งาน
นับตัวอักษรตามนิยาม Unicode
เครื่องมือนี้นับตัวอักษรโดยใช้หมวดหมู่ Letter ของ Unicode ซึ่งครอบคลุมตัวอักษรจากหลายภาษา ไม่ใช่แค่ภาษาอังกฤษ เช่น ตัวอักษรไทย ก ข ค, ตัวอักษรจีน, ตัวอักษรอาหรับ เป็นต้น เครื่องหมายวรรคตอน สัญลักษณ์ และอีโมจิจะไม่ถูกนับรวมในจำนวนตัวอักษร
ตัวเลือกการไม่นับช่องว่างและตัวเลข
ค่าเริ่มต้น ตัวเลือก "ไม่รวมช่องว่าง" และ "ไม่รวมตัวเลข" จะถูกปิดอยู่ หมายความว่าช่องว่างและตัวเลขจะถูกรวมอยู่ในการนับอักขระ แต่จะไม่ถูกนับเป็นตัวอักษร หากคุณเปิดตัวเลือกเหล่านี้ ช่องว่างและตัวเลขจะถูกตัดออกก่อนการนับอักขระที่ประมวลผล
ตัวอย่างการทำงานจริง
ลองพิมพ์ข้อความ Hello 123! ด้วยการตั้งค่าเริ่มต้น (ไม่รวมช่องว่างและตัวเลขถูกปิด) ผลลัพธ์ที่ได้คือ:
- ตัวอักษร (letters): 5 (ได้แก่ H, e, l, l, o)
- อักขระที่ประมวลผล (processed characters): 6 (นับ H, e, l, l, o, ! โดยไม่นับช่องว่างและตัวเลข เนื่องจากถูกตัดออก)
- อักขระต้นฉบับ (original characters): 10 (นับทุกโค้ดพอยต์ในข้อความต้นฉบับ รวมช่องว่าง ตัวเลข และเครื่องหมาย)
หากเปิดตัวเลือก "ไม่รวมตัวเลข" ตัวเลข 1, 2, 3 จะถูกตัดออก ทำให้จำนวนอักขระที่ประมวลผลเพิ่มขึ้นเป็น 9 (แต่ตัวเลขเหล่านั้นก็ไม่ถูกนับเป็นตัวอักษรอยู่ดี)
ข้อควรทราบเกี่ยวกับการนับ
- การนับอักขระนับตาม โค้ดพอยต์ (code points) ของ Unicode ซึ่งอาจแตกต่างจากจำนวนกราฟีมคลัสเตอร์ (grapheme clusters) ที่ผู้ใช้มองเห็น เช่น ตัวอักษรที่มีเครื่องหมายประกอบ (เช่น é ที่ประกอบด้วย e + ตัวกำกับเสียง) หรืออีโมจิที่ประกอบด้วยหลายโค้ดพอยต์ จะถูกนับเป็นหลายโค้ดพอยต์
- การนับทั้งหมดเกิดขึ้นในเบราว์เซอร์ของคุณเท่านั้น ไม่มีการส่งข้อมูลไปยังเซิร์ฟเวอร์
- เครื่องมือนี้ไม่นับคำ ไบต์ ขนาดไฟล์ UTF-8 เวลาอ่าน หรือจำนวนกลิฟต์เฉพาะแบบอักษร
คำถามที่พบบ่อย
1. ทำไมจำนวนตัวอักษรกับจำนวนอักขระที่ประมวลผลจึงต่างกัน?
จำนวนตัวอักษรนับเฉพาะอักขระที่อยู่ในหมวดหมู่ Letter ของ Unicode เช่น ตัวอักษรไทยและอังกฤษ ส่วนจำนวนอักขระที่ประมวลผลจะนับโค้ดพอยต์ทั้งหมดหลังจากตัดช่องว่างและตัวเลขตามตัวเลือกที่เลือก ซึ่งรวมถึงเครื่องหมายวรรคตอนและสัญลักษณ์ด้วย ตัวอย่างเช่น ข้อความ "สวัสดี!" มีตัวอักษร 6 ตัว แต่จำนวนอักขระที่ประมวลผลคือ 7 เพราะรวมเครื่องหมายตกใจ
2. เครื่องมือนับตัวอักษรภาษาไทยได้ถูกต้องหรือไม่?
ได้ เนื่องจากใช้หมวดหมู่ Letter ของ Unicode ซึ่งรวมถึงตัวอักษรไทยทุกตัว รวมถึงสระและวรรณยุกต์ที่อยู่เหนือหรือใต้พยัญชนะ อย่างไรก็ตาม การนับจะนับตามโค้ดพอยต์ ดังนั้นสระที่ซ้อนกันอาจถูกนับแยกจากพยัญชนะ ซึ่งอาจทำให้จำนวนมากกว่าจำนวนคำที่ตาเห็น
3. การนับอักขระต้นฉบับกับอักขระที่ประมวลผลต่างกันอย่างไร?
อักขระต้นฉบับคือจำนวนโค้ดพอยต์ทั้งหมดในข้อความที่คุณป้อน โดยไม่มีการตัดอะไรออก ส่วนอักขระที่ประมวลผลคือจำนวนโค้ดพอยต์หลังจากใช้ตัวเลือกไม่รวมช่องว่างและไม่รวมตัวเลขแล้ว ตัวอย่างเช่น ข้อความ "Hello 123!" มีอักขระต้นฉบับ 10 ตัว แต่เมื่อไม่รวมช่องว่างและตัวเลข จะเหลืออักขระที่ประมวลผล 6 ตัว (Hello!)
การประมวลผลเกิดขึ้นภายในเบราว์เซอร์ของคุณ