UTILS.
100% w przeglądarce
🔤

Konwerter punktów kodowych Unicode

Zbadaj tekst i przekonwertuj każdy znak na jego punkt kodowy Unicode, bajty UTF-8/UTF-16, encję HTML i escape — lub odbuduj tekst z punktów kodowych.

Wpisz tekst lub punkty kodowe powyżej.

O tym narzędziu

Konwerter punktów kodowych Unicode rozkłada tekst znak po znaku i pokazuje każdą powszechną reprezentację każdego z nich, a także działa wstecz, aby odbudować ciąg z punktów kodowych, które wkleisz. W trybie do przodu iteruje po punktach kodowych (a nie po jednostkach UTF-16), więc znaki astralne i emoji złożone z par surogatów są poprawnie obsługiwane jako pojedyncze znaki.

Dla każdego znaku podaje punkt kodowy w hex U+, dziesiętny punkt kodowy, sekwencję bajtów UTF-8 w hex (za pomocą TextEncoder przeglądarki), jednostki kodowe UTF-16 w hex, numeryczną encję HTML (&#nnnn;) oraz escape JavaScript/JSON (\uXXXX lub \u{...} dla punktów kodowych powyżej U+FFFF). Jest to idealne do debugowania problemów z kodowaniem, wykrywania niewidocznych lub podobnie wyglądających znaków albo budowania sekwencji escape do kodu źródłowego.

W trybie odwrotnym wklejasz punkty kodowe w niemal dowolnej notacji — U+1F600, zwykłe dziesiętne, \uXXXX, \u{1F600}, 😀, 😀 lub hex z prefiksem 0x, rozdzielone spacjami lub przecinkami — a narzędzie sprawdza każdy (odrzucając wartości powyżej U+10FFFF i osamotnione surogaty) i rekonstruuje ciąg za pomocą String.fromCodePoint. Całe przetwarzanie jest lokalne dla Twojej przeglądarki, więc prywatny tekst nigdy nie opuszcza strony.

Najczęściej zadawane pytania

Czy obsługuje emoji i znaki astralne?
Tak. Tryb do przodu iteruje po punktach kodowych Unicode, więc emoji jak 😀 (U+1F600), które jest przechowywane jako para surogatów UTF-16, jest traktowane jako jeden znak, a jego escape jest emitowany jako \u{1F600}.
Jakie formaty akceptuje tryb odwrotny?
Hex U+XXXX, zwykłe dziesiętne, escape JavaScript \uXXXX i \u{XXXXX}, encje HTML &#nnnn; i &#xHHHH; oraz hex z prefiksem 0x. Rozdziel wiele punktów kodowych spacjami lub przecinkami, a ciąg zostanie odbudowany w kolejności.
Jaka jest różnica między kolumnami UTF-8 i UTF-16?
UTF-8 pokazuje 1–4 bajty użyte do przechowania znaku w kodowaniu UTF-8, natomiast UTF-16 pokazuje 16-bitowe jednostki kodowe (jedną lub dwie dla pary surogatów). Oba są podane w hex dla tego samego znaku.
Czy nieprawidłowe dane wejściowe są odrzucane?
Tak. Tryb odwrotny oznacza wszystko, co nie jest prawidłową skalarną wartością Unicode — punkty kodowe powyżej U+10FFFF lub w zakresie surogatów U+D800–U+DFFF — więc nigdy nie zbudujesz zniekształconego ciągu.

Więcej narzędzi