Bu araç hakkında
Unicode Karakter İnceleyici, bir dizeyi tek tek kod noktalarına ayırır ve her biri hakkında her şeyi gösterir. 16-bit birim yerine kod noktasına göre yineler, bu yüzden vekil çiftlerinden oluşan astral karakterler ve emojiler doğru şekilde ele alınır. Her kod noktası için glifi, U+XXXX hex değerini, ondalık değeri, iyi bilinen karakterler için bir adı, genel kategoriyi ve ait olduğu Unicode bloğunu alırsınız.
Tüm analiz algoritmik olarak tarayıcınızda türetilir ve hiçbir şey yüklenmez. Kodlamalar ilk ilkelerden hesaplanır: UTF-8 baytları 1'den 4'e kadar bayt kodlama kurallarını izler, UTF-16 kod birimleri BMP'de tek bir birimdir veya üzerinde bir yüksek/düşük vekil çiftidir (D800–DBFF / DC00–DFFF), HTML sayısal entity'si &#nnnn;'dir, JavaScript kaçışı BMP için \uXXXX veya astral kod noktaları için \u{XXXXX}'tir ve yüzde kodlaması, UTF-8 baytlarının %XX olarak yazılmasıdır. Genel kategori (Lu, Ll, Nd, Mn, Zs, Cc vb.) Unicode özellik-kaçış düzenli ifadeleriyle algılanır.
İnceleyici, genellikle hatalara neden olan veya metni gizlemek için kullanılan karakterleri işaretler: sıfır genişlikli karakterler (200B–200D, 2060, FEFF), çift yönlü kontroller (200E, 200F, 202A–202E, 2066–2069), birleşen işaretler ve C0/C1 kontrol karakterleri — bunlar bir nokta olarak gösterilir, böylece görünmez içerik görünür hale gelir. Bir özet satırı, kod noktası sayısını, UTF-16 uzunluğunu (String.length) ve toplam UTF-8 bayt sayısını bildirir. Bu araç inceleme içindir; NFC ve NFD arasında normalleştirmek için Unicode normalleştiriciyi kullanın. Tam dökümü sekmeyle ayrılmış metin olarak kopyalayın.