UTILS.
۱۰۰٪ در مرورگر
🔤

مبدل نقطه‌کد یونیکد

متن را بازرسی کنید و هر نویسه را به نقطه‌کد یونیکد، بایت‌های UTF-8/UTF-16، موجودیت HTML و escape آن تبدیل کنید — یا متن را از نقطه‌کدها بازسازی کنید.

متن یا نقطه‌کدها را در بالا وارد کنید.

درباره این ابزار

مبدل نقطه‌کد یونیکد، متن را نویسه‌به‌نویسه تجزیه می‌کند و هر بازنمایی رایج هر یک را نشان می‌دهد، و همچنین به‌صورت معکوس کار می‌کند تا یک رشته را از نقطه‌کدهایی که می‌چسبانید بازسازی کند. در حالت رو به جلو بر اساس نقطه‌کد پیمایش می‌کند (نه بر اساس واحد UTF-16)، بنابراین نویسه‌های astral و اموجی‌های ساخته‌شده از جفت‌های surrogate به‌درستی به‌عنوان تک نویسه مدیریت می‌شوند.

برای هر نویسه، نقطه‌کد hex به‌صورت U+، نقطه‌کد اعشاری، دنباله‌ی بایت UTF-8 در hex (از طریق TextEncoder مرورگر)، واحدهای کد UTF-16 در hex، موجودیت عددی HTML (&#nnnn;)، و escape جاوااسکریپت/JSON (\uXXXX، یا \u{...} برای نقطه‌کدهای بالای U+FFFF) را گزارش می‌دهد. این برای اشکال‌زدایی مسائل رمزگذاری، شناسایی نویسه‌های نامرئی یا شبیه‌به‌هم، یا ساخت دنباله‌های escape برای کد منبع ایده‌آل است.

در حالت معکوس، نقطه‌کدها را تقریباً در هر نماد می‌چسبانید — U+1F600، اعشاری ساده، \uXXXX، \u{1F600}، 😀، 😀 یا hex با پیشوند 0x، جدا شده با فاصله یا ویرگول — و ابزار هر یک را اعتبارسنجی می‌کند (رد کردن مقادیر بالای U+10FFFF و surrogateهای تنها) و رشته را با String.fromCodePoint بازسازی می‌کند. تمام پردازش محلی در مرورگر شماست، بنابراین متن خصوصی هرگز صفحه را ترک نمی‌کند.

پرسش‌های پرتکرار

آیا اموجی و نویسه‌های astral را مدیریت می‌کند؟
بله. حالت رو به جلو بر اساس نقطه‌کد یونیکد پیمایش می‌کند، بنابراین یک اموجی مانند 😀 (U+1F600)، که به‌صورت یک جفت surrogate در UTF-16 ذخیره می‌شود، به‌عنوان یک نویسه در نظر گرفته می‌شود و escape آن به‌صورت \u{1F600} صادر می‌شود.
حالت معکوس چه قالب‌هایی را می‌پذیرد؟
hex به‌صورت U+XXXX، اعشاری ساده، escapeهای جاوااسکریپت \uXXXX و \u{XXXXX}، موجودیت‌های HTML &#nnnn; و &#xHHHH;، و hex با پیشوند 0x. چند نقطه‌کد را با فاصله یا ویرگول جدا کنید و رشته به‌ترتیب بازسازی می‌شود.
تفاوت میان ستون‌های UTF-8 و UTF-16 چیست؟
UTF-8 بایت‌های 1 تا 4 استفاده‌شده برای ذخیره‌ی نویسه در رمزگذاری UTF-8 را نشان می‌دهد، در حالی که UTF-16 واحدهای کد 16 بیتی (یک، یا دو برای یک جفت surrogate) را نشان می‌دهد. هر دو برای همان نویسه به‌صورت hex داده می‌شوند.
آیا ورودی نامعتبر رد می‌شود؟
بله. حالت معکوس هرچیزی را که یک مقدار اسکالر یونیکد معتبر نیست علامت‌گذاری می‌کند — نقطه‌کدهای بالای U+10FFFF یا در بازه‌ی surrogate U+D800–U+DFFF — بنابراین هرگز رشته‌ی معیوبی نمی‌سازید.

ابزارهای بیشتر