UTILS.
100% в браузере
🔤

Конвертер кодовых точек Unicode

Изучите текст и конвертируйте каждый символ в его кодовую точку Unicode, байты UTF-8/UTF-16, HTML-сущность и escape — или восстановите текст из кодовых точек.

Введите текст или кодовые точки выше.

Об этом инструменте

Конвертер кодовых точек Unicode разбивает текст символ за символом и показывает каждое распространённое представление каждого из них, а также работает в обратную сторону, восстанавливая строку из кодовых точек, которые вы вставляете. В прямом режиме он итерирует по кодовым точкам (а не по единицам UTF-16), поэтому астральные символы и эмодзи, состоящие из суррогатных пар, корректно обрабатываются как отдельные символы.

Для каждого символа он сообщает шестнадцатеричную кодовую точку U+, десятичную кодовую точку, последовательность байтов UTF-8 в hex (через TextEncoder браузера), кодовые единицы UTF-16 в hex, числовую HTML-сущность (&#nnnn;) и escape JavaScript/JSON (\uXXXX или \u{...} для кодовых точек выше U+FFFF). Это идеально для отладки проблем кодирования, обнаружения невидимых или похожих символов или построения escape-последовательностей для исходного кода.

В обратном режиме вы вставляете кодовые точки почти в любой нотации — U+1F600, обычное десятичное, \uXXXX, \u{1F600}, 😀, 😀 или hex с префиксом 0x, разделённые пробелами или запятыми — и инструмент проверяет каждую (отклоняя значения выше U+10FFFF и одиночные суррогаты) и реконструирует строку с помощью String.fromCodePoint. Вся обработка локальна для вашего браузера, поэтому приватный текст никогда не покидает страницу.

Часто задаваемые вопросы

Обрабатывает ли он эмодзи и астральные символы?
Да. Прямой режим итерирует по кодовым точкам Unicode, поэтому эмодзи вроде 😀 (U+1F600), которое хранится как суррогатная пара UTF-16, трактуется как один символ, и его escape выдаётся как \u{1F600}.
Какие форматы принимает обратный режим?
Hex U+XXXX, обычное десятичное, escape JavaScript \uXXXX и \u{XXXXX}, HTML-сущности &#nnnn; и &#xHHHH; и hex с префиксом 0x. Разделяйте несколько кодовых точек пробелами или запятыми, и строка восстанавливается по порядку.
В чём разница между столбцами UTF-8 и UTF-16?
UTF-8 показывает 1–4 байта, используемые для хранения символа в кодировке UTF-8, тогда как UTF-16 показывает 16-битные кодовые единицы (одна или две для суррогатной пары). Оба даны как hex для одного и того же символа.
Отклоняется ли недопустимый ввод?
Да. Обратный режим помечает всё, что не является допустимым скалярным значением Unicode — кодовые точки выше U+10FFFF или в диапазоне суррогатов U+D800–U+DFFF — поэтому вы никогда не построите некорректную строку.

Больше инструментов