UTILS.
100% no navegador
🔤

Conversor de Ponto de Código Unicode

Inspecione texto e converta cada caractere em seu ponto de código Unicode, bytes UTF-8/UTF-16, entidade HTML e escape — ou reconstrua texto a partir de pontos de código.

Digite texto ou pontos de código acima.

Sobre esta ferramenta

O Conversor de Ponto de Código Unicode decompõe o texto caractere por caractere e mostra todas as representações comuns de cada um, e também funciona no sentido inverso para reconstruir uma string a partir de pontos de código que você cola. No modo direto ele itera por ponto de código (não por unidade UTF-16), então caracteres astrais e emoji feitos de pares substitutos são tratados corretamente como caracteres únicos.

Para cada caractere ele informa o ponto de código hex U+, o ponto de código decimal, a sequência de bytes UTF-8 em hex (via o TextEncoder do navegador), as unidades de código UTF-16 em hex, a entidade HTML numérica (&#nnnn;), e o escape JavaScript/JSON (\uXXXX, ou \u{...} para pontos de código acima de U+FFFF). Isso é ideal para depurar problemas de codificação, identificar caracteres invisíveis ou parecidos, ou construir sequências de escape para código-fonte.

No modo inverso você cola pontos de código em quase qualquer notação — U+1F600, decimal simples, \uXXXX, \u{1F600}, 😀, 😀 ou hex prefixado com 0x, separados por espaços ou vírgulas — e a ferramenta valida cada um (rejeitando valores acima de U+10FFFF e substitutos isolados) e reconstrói a string com String.fromCodePoint. Todo o processamento é local ao seu navegador, então o texto privado nunca sai da página.

Perguntas frequentes

Ele lida com emoji e caracteres astrais?
Sim. O modo direto itera por ponto de código Unicode, então um emoji como 😀 (U+1F600), que é armazenado como um par substituto UTF-16, é tratado como um caractere e seu escape é emitido como \u{1F600}.
Quais formatos o modo inverso aceita?
Hex U+XXXX, decimal simples, escapes JavaScript \uXXXX e \u{XXXXX}, entidades HTML &#nnnn; e &#xHHHH;, e hex prefixado com 0x. Separe vários pontos de código com espaços ou vírgulas e a string é reconstruída em ordem.
Qual a diferença entre as colunas UTF-8 e UTF-16?
UTF-8 mostra os 1–4 bytes usados para armazenar o caractere na codificação UTF-8, enquanto UTF-16 mostra as unidades de código de 16 bits (uma, ou duas para um par substituto). Ambas são dadas em hex para o mesmo caractere.
A entrada inválida é rejeitada?
Sim. O modo inverso sinaliza qualquer coisa que não seja um valor escalar Unicode válido — pontos de código acima de U+10FFFF ou na faixa de substitutos U+D800–U+DFFF — para que você nunca construa uma string malformada.

Mais ferramentas