UTILS.
100% у браузері
🔤

Конвертер кодових точок Unicode

Огляньте текст і конвертуйте кожен символ у його кодову точку Unicode, байти UTF-8/UTF-16, HTML-сутність та escape — або відновіть текст із кодових точок.

Введіть текст або кодові точки вище.

Про цей інструмент

Конвертер кодових точок Unicode розбиває текст символ за символом і показує кожне поширене подання кожного з них, а також працює у зворотному напрямку, щоб відновити рядок із кодових точок, які ви вставляєте. У прямому режимі він ітерує за кодовою точкою (а не за одиницею UTF-16), тож астральні символи й емодзі, складені з сурогатних пар, правильно обробляються як окремі символи.

Для кожного символу він повідомляє шістнадцяткову кодову точку U+, десяткову кодову точку, послідовність байтів UTF-8 у hex (через TextEncoder браузера), кодові одиниці UTF-16 у hex, числову HTML-сутність (&#nnnn;) і escape JavaScript/JSON (\uXXXX, або \u{...} для кодових точок вище U+FFFF). Це ідеально для налагодження проблем із кодуванням, виявлення невидимих чи схожих символів або побудови escape-послідовностей для вихідного коду.

У зворотному режимі ви вставляєте кодові точки майже в будь-якій нотації — U+1F600, звичайний десятковий, \uXXXX, \u{1F600}, 😀, 😀 чи hex із префіксом 0x, розділені пробілами чи комами — і інструмент перевіряє кожну (відхиляючи значення вище U+10FFFF і поодинокі сурогати) та відновлює рядок за допомогою String.fromCodePoint. Уся обробка локальна для вашого браузера, тож приватний текст ніколи не залишає сторінку.

Поширені запитання

Чи обробляє він емодзі й астральні символи?
Так. Прямий режим ітерує за кодовою точкою Unicode, тож емодзі на кшталт 😀 (U+1F600), що зберігається як сурогатна пара UTF-16, розглядається як один символ, а його escape виводиться як \u{1F600}.
Які формати приймає зворотний режим?
Hex U+XXXX, звичайний десятковий, escape JavaScript \uXXXX і \u{XXXXX}, HTML-сутності &#nnnn; і &#xHHHH; та hex із префіксом 0x. Розділяйте кілька кодових точок пробілами чи комами, і рядок відновлюється по порядку.
У чому різниця між стовпцями UTF-8 і UTF-16?
UTF-8 показує 1–4 байти, використані для зберігання символу в кодуванні UTF-8, а UTF-16 показує 16-бітні кодові одиниці (одна, або дві для сурогатної пари). Обидва наведено як hex для того самого символу.
Чи відхиляється недійсне введення?
Так. Зворотний режим позначає все, що не є дійсним скалярним значенням Unicode — кодові точки вище U+10FFFF або в діапазоні сурогатів U+D800–U+DFFF — тож ви ніколи не побудуєте некоректний рядок.

Більше інструментів