Informazioni su questo strumento
L'Ispettore di caratteri Unicode divide una stringa nei suoi singoli code point e mostra tutto su ciascuno. Itera per code point (non per unità a 16 bit), così i caratteri astrali e le emoji composte da coppie surrogate vengono gestiti correttamente. Per ogni code point ottieni il glifo, il suo valore esadecimale U+XXXX, il valore decimale, un nome per i caratteri ben noti, la categoria generale e il blocco Unicode a cui appartiene.
Tutta l'analisi è derivata algoritmicamente nel tuo browser e nulla viene caricato. Le codifiche vengono calcolate da principi primi: i byte UTF-8 seguono le regole di codifica da 1 a 4 byte, le unità di codice UTF-16 sono una singola unità nel BMP o una coppia surrogata alta/bassa (D800–DBFF / DC00–DFFF) al di sopra, l'entità numerica HTML è &#nnnn;, l'escape JavaScript è \uXXXX per il BMP o \u{XXXXX} per i code point astrali, e il percent-encoding sono i byte UTF-8 scritti come %XX. La categoria generale (Lu, Ll, Nd, Mn, Zs, Cc, e così via) viene rilevata con espressioni regolari di property-escape Unicode.
L'ispettore segnala i caratteri che spesso causano bug o sono usati per nascondere testo: caratteri a larghezza zero (200B–200D, 2060, FEFF), controlli bidirezionali (200E, 200F, 202A–202E, 2066–2069), segni combinanti e caratteri di controllo C0/C1 — questi vengono mostrati come un punto così il contenuto invisibile diventa visibile. Una riga di riepilogo riporta il conteggio dei code point, la lunghezza UTF-16 (String.length) e il conteggio totale di byte UTF-8. Questo strumento serve per l'ispezione; per normalizzare tra NFC e NFD usa il normalizzatore Unicode. Copia la scomposizione completa come testo separato da tabulazioni.