UTILS.
100% nel browser
🔤

Convertitore di code point Unicode

Ispeziona il testo e converti ogni carattere nel suo code point Unicode, byte UTF-8/UTF-16, entità HTML ed escape — o ricostruisci il testo dai code point.

Inserisci testo o code point qui sopra.

Informazioni su questo strumento

Il Convertitore di code point Unicode scompone il testo carattere per carattere e mostra ogni rappresentazione comune di ciascuno, e funziona anche in senso inverso per ricostruire una stringa dai code point che incolli. In modalità diretta itera per code point (non per unità UTF-16), quindi i caratteri astrali e le emoji composte da coppie surrogate sono gestiti correttamente come singoli caratteri.

Per ogni carattere riporta il code point esadecimale U+, il code point decimale, la sequenza di byte UTF-8 in esadecimale (tramite il TextEncoder del browser), le unità di codice UTF-16 in esadecimale, l'entità HTML numerica (&#nnnn;), e l'escape JavaScript/JSON (\uXXXX, o \u{...} per i code point sopra U+FFFF). È ideale per il debug di problemi di codifica, per individuare caratteri invisibili o simili, o per costruire sequenze di escape per il codice sorgente.

In modalità inversa incolli i code point in quasi qualsiasi notazione — U+1F600, decimale semplice, \uXXXX, \u{1F600}, 😀, 😀 o esadecimale con prefisso 0x, separati da spazi o virgole — e lo strumento convalida ciascuno (rifiutando valori sopra U+10FFFF e surrogati isolati) e ricostruisce la stringa con String.fromCodePoint. Tutta l'elaborazione è locale al tuo browser, quindi il testo privato non lascia mai la pagina.

Domande frequenti

Gestisce emoji e caratteri astrali?
Sì. La modalità diretta itera per code point Unicode, quindi un'emoji come 😀 (U+1F600), memorizzata come coppia surrogata UTF-16, è trattata come un singolo carattere e il suo escape è emesso come \u{1F600}.
Quali formati accetta la modalità inversa?
Esadecimale U+XXXX, decimale semplice, escape JavaScript \uXXXX e \u{XXXXX}, entità HTML &#nnnn; e &#xHHHH;, ed esadecimale con prefisso 0x. Separa più code point con spazi o virgole e la stringa viene ricostruita in ordine.
Qual è la differenza tra le colonne UTF-8 e UTF-16?
UTF-8 mostra gli 1–4 byte usati per memorizzare il carattere nella codifica UTF-8, mentre UTF-16 mostra le unità di codice a 16 bit (una, o due per una coppia surrogata). Entrambe sono fornite in esadecimale per lo stesso carattere.
L'input non valido viene rifiutato?
Sì. La modalità inversa segnala tutto ciò che non è un valore scalare Unicode valido — code point sopra U+10FFFF o nell'intervallo dei surrogati U+D800–U+DFFF — così non costruisci mai una stringa malformata.

Altri strumenti