UTILS.
100% di peramban
🔤

Konverter Titik Kode Unicode

Periksa teks dan konversi setiap karakter ke titik kode Unicode, byte UTF-8/UTF-16, entitas HTML, dan escape — atau bangun ulang teks dari titik kode.

Masukkan teks atau titik kode di atas.

Tentang alat ini

Konverter Titik Kode Unicode memecah teks karakter demi karakter dan menampilkan setiap representasi umum dari masing-masing, dan juga bekerja terbalik untuk membangun ulang string dari titik kode yang Anda tempel. Dalam mode maju, alat ini beriterasi berdasarkan titik kode (bukan berdasarkan unit UTF-16), sehingga karakter astral dan emoji yang terdiri dari pasangan surrogate ditangani dengan benar sebagai karakter tunggal.

Untuk setiap karakter alat ini melaporkan titik kode hex U+, titik kode desimal, urutan byte UTF-8 dalam hex (melalui TextEncoder browser), unit kode UTF-16 dalam hex, entitas HTML numerik (&#nnnn;), dan escape JavaScript/JSON (\uXXXX, atau \u{...} untuk titik kode di atas U+FFFF). Ini ideal untuk men-debug masalah enkode, menemukan karakter tak terlihat atau serupa, atau membuat urutan escape untuk kode sumber.

Dalam mode terbalik Anda menempel titik kode dalam hampir semua notasi — U+1F600, desimal biasa, \uXXXX, \u{1F600}, 😀, 😀 atau hex berawalan 0x, dipisahkan oleh spasi atau koma — dan alat ini memvalidasi masing-masing (menolak nilai di atas U+10FFFF dan surrogate tunggal) serta merekonstruksi string dengan String.fromCodePoint. Semua pemrosesan bersifat lokal di browser Anda, jadi teks pribadi tidak pernah meninggalkan halaman.

Pertanyaan yang sering diajukan

Apakah alat ini menangani emoji dan karakter astral?
Ya. Mode maju beriterasi berdasarkan titik kode Unicode, jadi emoji seperti 😀 (U+1F600), yang disimpan sebagai pasangan surrogate UTF-16, diperlakukan sebagai satu karakter dan escapenya dipancarkan sebagai \u{1F600}.
Format apa yang diterima mode terbalik?
Hex U+XXXX, desimal biasa, escape JavaScript \uXXXX dan \u{XXXXX}, entitas HTML &#nnnn; dan &#xHHHH;, serta hex berawalan 0x. Pisahkan beberapa titik kode dengan spasi atau koma dan string dibangun ulang secara berurutan.
Apa perbedaan antara kolom UTF-8 dan UTF-16?
UTF-8 menampilkan 1–4 byte yang digunakan untuk menyimpan karakter dalam enkode UTF-8, sedangkan UTF-16 menampilkan unit kode 16-bit (satu, atau dua untuk pasangan surrogate). Keduanya diberikan sebagai hex untuk karakter yang sama.
Apakah masukan tidak valid ditolak?
Ya. Mode terbalik menandai apa pun yang bukan nilai skalar Unicode valid — titik kode di atas U+10FFFF atau dalam rentang surrogate U+D800–U+DFFF — jadi Anda tidak pernah membangun string yang salah bentuk.

Alat lainnya