UTILS.
100% in de browser
🔤

Unicode-codepunt-converter

Inspecteer tekst en converteer elk teken naar zijn Unicode-codepunt, UTF-8/UTF-16-bytes, HTML-entiteit en escape — of bouw tekst opnieuw op uit codepunten.

Voer hierboven tekst of codepunten in.

Over deze tool

De Unicode-codepunt-converter breekt tekst teken voor teken af en toont elke gangbare weergave van elk teken, en werkt ook omgekeerd om een string opnieuw op te bouwen uit codepunten die je plakt. In de voorwaartse modus itereert hij per codepunt (niet per UTF-16-eenheid), zodat astrale tekens en emoji die uit surrogate pairs bestaan correct als enkele tekens worden behandeld.

Voor elk teken rapporteert het het U+ hex-codepunt, het decimale codepunt, de UTF-8-bytereeks in hex (via de TextEncoder van de browser), de UTF-16-code-eenheden in hex, de numerieke HTML-entiteit (&#nnnn;), en de JavaScript/JSON-escape (\uXXXX, of \u{...} voor codepunten boven U+FFFF). Dit is ideaal voor het debuggen van coderingsproblemen, het opsporen van onzichtbare of gelijkende tekens, of het bouwen van escape-sequenties voor broncode.

In de omgekeerde modus plak je codepunten in vrijwel elke notatie — U+1F600, gewone decimaal, \uXXXX, \u{1F600}, 😀, 😀 of 0x-voorvoegde hex, gescheiden door spaties of komma's — en de tool valideert elk (waarden boven U+10FFFF en losstaande surrogates worden geweigerd) en reconstrueert de string met String.fromCodePoint. Alle verwerking is lokaal in je browser, dus privétekst verlaat nooit de pagina.

Veelgestelde vragen

Verwerkt het emoji en astrale tekens?
Ja. De voorwaartse modus itereert per Unicode-codepunt, dus een emoji zoals 😀 (U+1F600), die als een UTF-16-surrogate-pair wordt opgeslagen, wordt als één teken behandeld en zijn escape wordt uitgevoerd als \u{1F600}.
Welke formaten accepteert de omgekeerde modus?
U+XXXX hex, gewone decimaal, \uXXXX en \u{XXXXX} JavaScript-escapes, HTML-entiteiten &#nnnn; en &#xHHHH;, en 0x-voorvoegde hex. Scheid meerdere codepunten met spaties of komma's en de string wordt op volgorde opnieuw opgebouwd.
Wat is het verschil tussen de UTF-8- en UTF-16-kolommen?
UTF-8 toont de 1–4 bytes die worden gebruikt om het teken op te slaan in de UTF-8-codering, terwijl UTF-16 de 16-bits code-eenheden toont (één, of twee voor een surrogate pair). Beide worden als hex gegeven voor hetzelfde teken.
Wordt ongeldige invoer geweigerd?
Ja. De omgekeerde modus markeert alles wat geen geldige Unicode-scalaire waarde is — codepunten boven U+10FFFF of in het surrogate-bereik U+D800–U+DFFF — zodat je nooit een misvormde string opbouwt.

Meer tools