حول هذه الأداة
يقسّم فاحص أحرف يونيكود سلسلة إلى نقاط الكود الفردية الخاصة بها ويُظهر كل شيء عن كل منها. يكرّر بنقطة الكود (لا بوحدة 16-bit)، فتُعالَج الأحرف الفلكية والإيموجي المكوّنة من أزواج بديلة بشكل صحيح. لكل نقطة كود تحصل على الرمز، وقيمته U+XXXX hex، والقيمة العشرية، واسم للأحرف المعروفة، والفئة العامة، وكتلة يونيكود التي ينتمي إليها.
يُشتق كل التحليل خوارزميًا في متصفحك ولا يُرفع أي شيء. تُحسب الترميزات من المبادئ الأساسية: تتبع بايتات UTF-8 قواعد الترميز من 1 إلى 4 بايتات، وتكون وحدات كود UTF-16 وحدة واحدة في BMP أو زوجًا بديلًا عاليًا/منخفضًا (D800–DBFF / DC00–DFFF) فوقها، والكيان الرقمي لـ HTML هو &#nnnn;، وتهريب JavaScript هو \uXXXX لـ BMP أو \u{XXXXX} لنقاط الكود الفلكية، وترميز النسبة هو بايتات UTF-8 مكتوبة كـ %XX. تُكتشف الفئة العامة (Lu, Ll, Nd, Mn, Zs, Cc، وهكذا) بتعبيرات نمطية لخصائص يونيكود.
يشير الفاحص إلى الأحرف التي كثيرًا ما تسبب أخطاءً أو تُستخدم لإخفاء النص: الأحرف الصفرية العرض (200B–200D، 2060، FEFF)، وعناصر التحكم ثنائية الاتجاه (200E، 200F، 202A–202E، 2066–2069)، وعلامات combining، وأحرف تحكم C0/C1 — تُعرض هذه كنقطة حتى يصبح المحتوى غير المرئي مرئيًا. يبلّغ سطر ملخص عن عدد نقاط الكود، وطول UTF-16 (String.length)، وإجمالي عدد بايتات UTF-8. هذه الأداة للفحص؛ وللتطبيع بين NFC وNFD استخدم مُطبّع يونيكود. انسخ التفصيل الكامل كنص مفصول بعلامات جدولة.