UTILS.
ทำงานในเบราว์เซอร์ 100%
🔤

ตัวแปลงจุดรหัส Unicode

ตรวจสอบข้อความและแปลงแต่ละอักขระเป็นจุดรหัส Unicode ไบต์ UTF-8/UTF-16 เอนทิตี HTML และ escape หรือสร้างข้อความใหม่จากจุดรหัส

ป้อนข้อความหรือจุดรหัสด้านบน

เกี่ยวกับเครื่องมือนี้

ตัวแปลงจุดรหัส Unicode จะแยกข้อความออกเป็นอักขระทีละตัวและแสดงการนำเสนอทั่วไปทุกแบบของแต่ละตัว และยังทำงานในทางกลับกันเพื่อสร้างสตริงใหม่จากจุดรหัสที่คุณวางเข้ามา ในโหมดไปข้างหน้า มันวนซ้ำตามจุดรหัส (ไม่ใช่ตามหน่วย UTF-16) ดังนั้นอักขระ astral และอีโมจิที่ประกอบด้วย surrogate pair จึงถูกจัดการอย่างถูกต้องเป็นอักขระเดียว

สำหรับแต่ละอักขระ มันรายงานจุดรหัส hex แบบ U+ จุดรหัสทศนิยม ลำดับไบต์ UTF-8 ในรูป hex (ผ่าน TextEncoder ของเบราว์เซอร์) หน่วยรหัส UTF-16 ในรูป hex เอนทิตี HTML เชิงตัวเลข (&#nnnn;) และ escape ของ JavaScript/JSON (\uXXXX หรือ \u{...} สำหรับจุดรหัสที่สูงกว่า U+FFFF) เหมาะสำหรับการดีบักปัญหาการเข้ารหัส การมองหาอักขระที่มองไม่เห็นหรือคล้ายกัน หรือการสร้างลำดับ escape สำหรับซอร์สโค้ด

ในโหมดย้อนกลับ คุณวางจุดรหัสในรูปแบบใดก็ได้เกือบทั้งหมด ไม่ว่าจะเป็น U+1F600, ทศนิยมธรรมดา, \uXXXX, \u{1F600}, 😀, 😀 หรือ hex ที่นำหน้าด้วย 0x คั่นด้วยช่องว่างหรือจุลภาค แล้วเครื่องมือจะตรวจสอบแต่ละตัว (ปฏิเสธค่าที่สูงกว่า U+10FFFF และ lone surrogate) และสร้างสตริงใหม่ด้วย String.fromCodePoint การประมวลผลทั้งหมดเป็นแบบภายในเบราว์เซอร์ของคุณ ข้อความส่วนตัวจึงไม่ออกจากหน้า

คำถามที่พบบ่อย

มันจัดการอีโมจิและอักขระ astral ได้ไหม?
ได้ โหมดไปข้างหน้าวนซ้ำตามจุดรหัส Unicode ดังนั้นอีโมจิเช่น 😀 (U+1F600) ซึ่งเก็บเป็น UTF-16 surrogate pair จึงถือเป็นอักขระเดียวและ escape ของมันจะถูกส่งออกเป็น \u{1F600}
โหมดย้อนกลับรับรูปแบบใดบ้าง?
hex แบบ U+XXXX, ทศนิยมธรรมดา, escape JavaScript แบบ \uXXXX และ \u{XXXXX}, เอนทิตี HTML แบบ &#nnnn; และ &#xHHHH; และ hex ที่นำหน้าด้วย 0x คั่นจุดรหัสหลายตัวด้วยช่องว่างหรือจุลภาค แล้วสตริงจะถูกสร้างใหม่ตามลำดับ
คอลัมน์ UTF-8 และ UTF-16 ต่างกันอย่างไร?
UTF-8 แสดง 1–4 ไบต์ที่ใช้เก็บอักขระในการเข้ารหัส UTF-8 ในขณะที่ UTF-16 แสดงหน่วยรหัส 16 บิต (หนึ่งหน่วย หรือสองหน่วยสำหรับ surrogate pair) ทั้งสองแสดงเป็น hex สำหรับอักขระเดียวกัน
อินพุตที่ไม่ถูกต้องถูกปฏิเสธไหม?
ใช่ โหมดย้อนกลับทำเครื่องหมายสิ่งใดก็ตามที่ไม่ใช่ค่าสเกลาร์ Unicode ที่ถูกต้อง คือจุดรหัสที่สูงกว่า U+10FFFF หรืออยู่ในช่วง surrogate U+D800–U+DFFF ดังนั้นคุณจะไม่สร้างสตริงที่ผิดรูปแบบ

เครื่องมือเพิ่มเติม