Об этом инструменте
Удаление акцентов и диакритики преобразует акцентированный текст в его форму с обычными буквами: café становится cafe, naïve становится naive, résumé становится resume, а Zürich становится Zurich. Это идеально для очистки данных для URL, слагов, имён файлов, имён пользователей, ключей поиска или любой системы, ожидающей ASCII без акцентов, сохраняя при этом ваши исходные пробелы, пунктуацию и регистр букв.
Под капотом он использует нормализацию Unicode. Текст нормализуется в форму NFD, которая разделяет акцентированную букву, такую как é, на базовую e плюс отдельный комбинирующий акцент, а затем каждый символ в блоке Combining Diacritical Marks (U+0300–U+036F) удаляется регулярным выражением. Этот единственный шаг чисто и обратимо для базовой буквы обрабатывает подавляющее большинство европейских акцентов.
У некоторых букв нет канонического разложения, поэтому небольшая явная резервная карта их покрывает: ø→o, ł→l, đ→d, ß→ss, æ→ae, œ→oe, þ→th, ð→d, ħ→h, ı→i и их заглавные, среди прочих. Необязательный переключатель "убрать всё не-ASCII" идёт дальше, отбрасывая любой оставшийся символ выше U+007F для гарантированно чистого ASCII-результата. Всё детерминировано и работает локально в вашем браузере — ваш текст никогда не загружается.