이 도구에 대하여
악센트 & 발음 부호 제거는 악센트가 붙은 텍스트를 일반 글자 형태로 변환합니다: café는 cafe가, naïve는 naive가, résumé는 resume가, Zürich는 Zurich가 됩니다. 원래의 공백, 문장 부호, 글자 대소문자를 보존하면서 URL, 슬러그, 파일 이름, 사용자 이름, 검색 키, 또는 악센트 없는 ASCII를 기대하는 모든 시스템을 위한 데이터를 정리하는 데 이상적입니다.
내부적으로는 유니코드 정규화를 사용합니다. 텍스트가 NFD 형식으로 정규화되어 é 같은 악센트 글자를 기본 e와 별도의 결합 악센트로 분리한 다음, 결합 발음 부호 블록(U+0300–U+036F)의 모든 문자를 정규 표현식으로 제거합니다. 이 한 단계가 대부분의 유럽 악센트를 기본 글자에 대해 깔끔하고 되돌릴 수 있게 처리합니다.
일부 글자는 정규 분해가 없으므로 작은 명시적 대체 맵이 그것들을 다룹니다: ø→o, ł→l, đ→d, ß→ss, æ→ae, œ→oe, þ→th, ð→d, ħ→h, ı→i 및 그 대문자 등. 선택적 "모든 비-ASCII 제거" 토글은 더 나아가 U+007F를 넘는 남은 문자를 모두 버려 순수 ASCII 결과를 보장합니다. 모든 것이 결정론적이며 브라우저에서 로컬로 실행됩니다 — 당신의 텍스트는 절대 업로드되지 않습니다.