このツールについて
音声エンコーダーは、単語や名前を音声コードに変換して、似た響きの名前が同じ値にマッピングされるようにします。これはあいまいな名前マッチング、系図検索、綴りのバリエーションの重複排除の裏にある仕組みです。デフォルトはAmerican Soundexで、4文字のコードです。最初の文字を残し、残りの子音を数字にマッピングします(B,F,P,V→1;C,G,J,K,Q,S,X,Z→2;D,T→3;L→4;M,N→5;R→6)。母音とH、W、Yは0にマッピングされます。
アルゴリズムは古典的なルールに正確に従います。隣接する、またはHかWのみで隔てられた同じ数字の連続は1つの数字にまとめられ、母音で隔てられた文字は別々にエンコードされます。すべてのゼロが削除され、残された最初の文字が前に付き、結果は最初の3桁を右側にゼロ埋めして長さ4にしたものになります。これがRobertとRupertがどちらもR163にエンコードされ、AshcraftがA261にエンコードされる理由です。
アルゴリズムのトグルをMetaphone(または「Both」)に切り替えると、より現代的な2つ目の音声表示が得られます。Metaphoneは英語の発音ルールを適用します — 黙字の削除、PH→F、TH→0(theta)、SH/TIA/SIO→X、軟音と硬音のCおよびG、など — 可変長のキーを生成し、英単語ではSoundexよりも正確に同音異義語をグループ化することがよくあります。すべては決定論的な状態機械であり、ブラウザ内でローカルに計算されます。データが照会・送信されることはありません。