이 도구에 대하여
음성 인코더는 단어나 이름을 음성 코드로 변환하여 비슷하게 들리는 이름이 같은 값으로 매핑되게 합니다 — 퍼지 이름 매칭, 족보 검색, 철자 변형 중복 제거의 비결입니다. 기본값은 네 글자 코드인 American Soundex입니다: 첫 글자를 유지한 뒤 나머지 자음을 숫자로 매핑하며(B,F,P,V→1; C,G,J,K,Q,S,X,Z→2; D,T→3; L→4; M,N→5; R→6), 모음과 H, W, Y는 0으로 매핑합니다.
이 알고리즘은 고전적인 규칙을 정확히 따릅니다. 인접하거나 H 또는 W로만 분리된 같은 숫자의 연속은 하나의 숫자로 축약되는 반면, 모음으로 분리된 글자는 개별적으로 인코딩됩니다. 모든 0은 제거되고, 유지된 첫 글자가 앞에 붙으며, 결과는 처음 세 자리 숫자를 0으로 오른쪽 채워 길이 4로 만든 것입니다. 이것이 Robert와 Rupert가 모두 R163으로 인코딩되고, Ashcraft가 A261로 인코딩되는 이유입니다.
알고리즘 토글을 Metaphone(또는 'Both')으로 전환하면 더 현대적인 두 번째 음성 뷰를 볼 수 있습니다. Metaphone은 영어 발음 규칙을 적용합니다 — 묵음 제거, PH→F, TH→0(세타), SH/TIA/SIO→X, 연음 대 경음 C와 G 등 — 가변 길이 키를 생성하여 영어 단어에서 Soundex보다 동음이의어를 더 정확하게 묶는 경우가 많습니다. 모든 것은 브라우저 안에서 로컬로 계산되는 결정론적 상태 기계이며, 조회되거나 전송되는 데이터는 없습니다.