UTILS.
100 % im Browser
🔤

Unicode-Codepunkt-Umrechner

Untersuche Text und wandle jedes Zeichen in seinen Unicode-Codepunkt, UTF-8-/UTF-16-Bytes, HTML-Entität und Escape um — oder baue Text aus Codepunkten wieder auf.

Gib oben Text oder Codepunkte ein.

Über dieses Tool

Der Unicode-Codepunkt-Umrechner zerlegt Text Zeichen für Zeichen und zeigt jede gängige Darstellung jedes einzelnen an, und er arbeitet auch rückwärts, um eine Zeichenkette aus eingefügten Codepunkten wieder aufzubauen. Im Vorwärtsmodus iteriert er nach Codepunkt (nicht nach UTF-16-Einheit), sodass astrale Zeichen und Emoji, die aus Surrogatpaaren bestehen, korrekt als einzelne Zeichen behandelt werden.

Für jedes Zeichen meldet er den U+-Hex-Codepunkt, den dezimalen Codepunkt, die UTF-8-Bytesequenz in Hex (über den TextEncoder des Browsers), die UTF-16-Codeeinheiten in Hex, die numerische HTML-Entität (&#nnnn;) und das JavaScript-/JSON-Escape (\uXXXX oder \u{...} für Codepunkte oberhalb von U+FFFF). Das ist ideal zum Debuggen von Kodierungsproblemen, zum Aufspüren unsichtbarer oder ähnlich aussehender Zeichen oder zum Erstellen von Escape-Sequenzen für Quellcode.

Im Rückwärtsmodus fügst du Codepunkte in nahezu jeder Notation ein — U+1F600, einfache Dezimalzahl, \uXXXX, \u{1F600}, 😀, 😀 oder 0x-präfigiertes Hex, getrennt durch Leerzeichen oder Kommas — und das Tool validiert jeden (weist Werte über U+10FFFF und einzelne Surrogate zurück) und rekonstruiert die Zeichenkette mit String.fromCodePoint. Die gesamte Verarbeitung ist lokal in deinem Browser, sodass privater Text die Seite nie verlässt.

Häufig gestellte Fragen

Behandelt es Emoji und astrale Zeichen?
Ja. Der Vorwärtsmodus iteriert nach Unicode-Codepunkt, sodass ein Emoji wie 😀 (U+1F600), das als UTF-16-Surrogatpaar gespeichert ist, als ein Zeichen behandelt wird und sein Escape als \u{1F600} ausgegeben wird.
Welche Formate akzeptiert der Rückwärtsmodus?
U+XXXX-Hex, einfache Dezimalzahl, \uXXXX- und \u{XXXXX}-JavaScript-Escapes, HTML-Entitäten &#nnnn; und &#xHHHH; sowie 0x-präfigiertes Hex. Trenne mehrere Codepunkte mit Leerzeichen oder Kommas, und die Zeichenkette wird in Reihenfolge wieder aufgebaut.
Was ist der Unterschied zwischen den UTF-8- und UTF-16-Spalten?
UTF-8 zeigt die 1–4 Bytes, die zum Speichern des Zeichens in der UTF-8-Kodierung verwendet werden, während UTF-16 die 16-Bit-Codeeinheiten zeigt (eine oder zwei bei einem Surrogatpaar). Beide werden als Hex für dasselbe Zeichen angegeben.
Wird ungültige Eingabe zurückgewiesen?
Ja. Der Rückwärtsmodus kennzeichnet alles, was kein gültiger Unicode-Skalarwert ist — Codepunkte über U+10FFFF oder im Surrogatbereich U+D800–U+DFFF —, sodass du nie eine fehlerhafte Zeichenkette erzeugst.

Weitere Tools