UTILS.
%100 tarayıcıda
🔤

Unicode Kod Noktası Dönüştürücü

Metni inceleyin ve her karakteri Unicode kod noktasına, UTF-8/UTF-16 baytlarına, HTML varlığına ve kaçış dizisine dönüştürün — veya kod noktalarından metni yeniden oluşturun.

Yukarıya metin veya kod noktaları girin.

Bu araç hakkında

Unicode Kod Noktası Dönüştürücü, metni karakter karakter parçalar ve her birinin her yaygın gösterimini gösterir; ayrıca yapıştırdığınız kod noktalarından bir dizeyi yeniden oluşturmak için tersine de çalışır. İleri modda kod noktasına göre yinelenir (UTF-16 birimine göre değil), böylece surrogate çiftlerinden oluşan astral karakterler ve emojiler tek karakter olarak doğru şekilde işlenir.

Her karakter için U+ hex kod noktasını, ondalık kod noktasını, hex cinsinden UTF-8 bayt dizisini (tarayıcının TextEncoder'ı aracılığıyla), hex cinsinden UTF-16 kod birimlerini, sayısal HTML varlığını (&#nnnn;) ve JavaScript/JSON kaçış dizisini (\uXXXX veya U+FFFF üzerindeki kod noktaları için \u{...}) raporlar. Bu, kodlama sorunlarını ayıklamak, görünmez veya benzer görünen karakterleri saptamak ya da kaynak kodu için kaçış dizileri oluşturmak için idealdir.

Ters modda kod noktalarını neredeyse her gösterimde yapıştırırsınız — U+1F600, düz ondalık, \uXXXX, \u{1F600}, 😀, 😀 veya 0x önekli hex, boşluk veya virgülle ayrılmış — ve araç her birini doğrular (U+10FFFF üzerindeki değerleri ve yalnız surrogate'leri reddeder) ve dizeyi String.fromCodePoint ile yeniden oluşturur. Tüm işlem tarayıcınıza yereldir, bu yüzden özel metin sayfadan asla çıkmaz.

Sık sorulan sorular

Emoji ve astral karakterleri işler mi?
Evet. İleri mod Unicode kod noktasına göre yinelenir, bu yüzden UTF-16 surrogate çifti olarak saklanan 😀 (U+1F600) gibi bir emoji tek karakter olarak ele alınır ve kaçış dizisi \u{1F600} olarak verilir.
Ters mod hangi biçimleri kabul eder?
U+XXXX hex, düz ondalık, \uXXXX ve \u{XXXXX} JavaScript kaçış dizileri, HTML varlıkları &#nnnn; ve &#xHHHH; ve 0x önekli hex. Birden fazla kod noktasını boşluk veya virgülle ayırın; dize sırayla yeniden oluşturulur.
UTF-8 ile UTF-16 sütunları arasındaki fark nedir?
UTF-8, karakteri UTF-8 kodlamasında saklamak için kullanılan 1–4 baytı gösterir, UTF-16 ise 16 bitlik kod birimlerini (bir veya bir surrogate çifti için iki) gösterir. İkisi de aynı karakter için hex olarak verilir.
Geçersiz girdi reddedilir mi?
Evet. Ters mod, geçerli bir Unicode skaler değeri olmayan her şeyi işaretler — U+10FFFF üzerindeki veya U+D800–U+DFFF surrogate aralığındaki kod noktaları — böylece hatalı biçimli bir dize asla oluşturmazsınız.

Daha fazla araç