UTILS.
100 % dans le navigateur
🔤

Convertisseur de points de code Unicode

Inspectez un texte et convertissez chaque caractère en son point de code Unicode, ses octets UTF-8/UTF-16, son entité HTML et son échappement — ou reconstruisez le texte à partir de points de code.

Saisissez du texte ou des points de code ci-dessus.

À propos de cet outil

Le Convertisseur de points de code Unicode décompose le texte caractère par caractère et affiche toutes les représentations courantes de chacun, et il fonctionne aussi en sens inverse pour reconstruire une chaîne à partir de points de code que vous collez. En mode direct, il itère par point de code (non par unité UTF-16), de sorte que les caractères astraux et les emoji composés de paires de substitution sont correctement traités comme des caractères uniques.

Pour chaque caractère, il indique le point de code hex U+, le point de code décimal, la séquence d'octets UTF-8 en hex (via le TextEncoder du navigateur), les unités de code UTF-16 en hex, l'entité HTML numérique (&#nnnn;), et l'échappement JavaScript/JSON (\uXXXX, ou \u{...} pour les points de code au-dessus de U+FFFF). C'est idéal pour déboguer les problèmes d'encodage, repérer des caractères invisibles ou trompeurs, ou construire des séquences d'échappement pour du code source.

En mode inverse, vous collez des points de code dans presque n'importe quelle notation — U+1F600, décimal simple, \uXXXX, \u{1F600}, 😀, 😀 ou hex préfixé de 0x, séparés par des espaces ou des virgules — et l'outil valide chacun (rejetant les valeurs au-dessus de U+10FFFF et les substituts isolés) et reconstruit la chaîne avec String.fromCodePoint. Tout le traitement est local à votre navigateur, donc le texte privé ne quitte jamais la page.

Foire aux questions

Gère-t-il les emoji et les caractères astraux ?
Oui. Le mode direct itère par point de code Unicode, donc un emoji comme 😀 (U+1F600), stocké comme une paire de substitution UTF-16, est traité comme un seul caractère et son échappement est émis sous forme \u{1F600}.
Quels formats le mode inverse accepte-t-il ?
Hex U+XXXX, décimal simple, échappements JavaScript \uXXXX et \u{XXXXX}, entités HTML &#nnnn; et &#xHHHH;, et hex préfixé de 0x. Séparez plusieurs points de code par des espaces ou des virgules et la chaîne est reconstruite dans l'ordre.
Quelle est la différence entre les colonnes UTF-8 et UTF-16 ?
UTF-8 affiche les 1 à 4 octets utilisés pour stocker le caractère dans l'encodage UTF-8, tandis que UTF-16 affiche les unités de code de 16 bits (une, ou deux pour une paire de substitution). Les deux sont données en hex pour le même caractère.
Les entrées invalides sont-elles rejetées ?
Oui. Le mode inverse signale tout ce qui n'est pas une valeur scalaire Unicode valide — les points de code au-dessus de U+10FFFF ou dans la plage de substitution U+D800–U+DFFF — pour que vous ne construisiez jamais une chaîne malformée.

Plus d'outils