UTILS.
100% ब्राउज़र में

Hamming दूरी कैलकुलेटर

दो समान-लंबाई वाली स्ट्रिंग, बिटस्ट्रिंग या हेक्स मानों में जहाँ-जहाँ अंतर हो उन स्थानों की गिनती करें, सामान्यीकृत दूरी और हाइलाइट किए गए मिसमैच diff के साथ।

आउटपुट

इस टूल के बारे में

Hamming दूरी कैलकुलेटर उन स्थानों की गिनती करता है जहाँ दो समान-लंबाई वाले इनपुट भिन्न होते हैं — error-detecting और error-correcting कोड के पीछे का मूल माप। दोनों इनपुट समान लंबाई के होने चाहिए; यदि नहीं हैं, तो टूल किसी संरेखण का अनुमान लगाने के बजाय प्रत्येक लंबाई के साथ स्पष्ट त्रुटि दिखाता है। यह कच्ची दूरी, सामान्यीकृत दूरी (दूरी ÷ लंबाई, 0 से 1 तक), तुलना लंबाई, मैच करने वाले स्थानों की संख्या, और प्रति-स्थान diff बताता है जो हर मिसमैच को लाल रंग में हाइलाइट करता है।

तीन मोड सामान्य मामलों को कवर करते हैं। टेक्स्ट मोड में यह स्ट्रिंग की कोड पॉइंट-दर-कोड पॉइंट तुलना करता है, इसलिए समान लंबाई का अर्थ है समान संख्या में कैरेक्टर। बाइनरी मोड में यह वैलिडेट करता है कि प्रत्येक इनपुट में समान लंबाई के केवल 0 और 1 हों और भिन्न बिट स्थानों की गिनती करता है — जो उनके XOR के popcount के समतुल्य है। हेक्स मोड में यह दोनों इनपुट को समान अंक-लंबाई के हेक्साडेसिमल के रूप में पार्स करता है, उन्हें nibble-दर-nibble XOR करता है, और सेट बिट्स को जोड़ता है, जो सही बिट-स्तरीय Hamming दूरी देता है; यहाँ लंबाई बिट्स की कुल संख्या है (हेक्स अंक × 4)।

गणना शुद्ध, नियतात्मक और पूरी तरह ऑफ़लाइन है — आप जो भी दर्ज करते हैं वह आपके ब्राउज़र से बाहर नहीं जाता। Hamming दूरी का उपयोग यह मापने के लिए किया जाता है कि दो codeword को कितनी single-bit त्रुटियाँ अलग करती हैं, स्थिर-लंबाई वाले हैश या फ़िंगरप्रिंट की तुलना करने के लिए, और bioinformatics में समान-लंबाई अनुक्रमों की तुलना करने के लिए। चूँकि इसके लिए समान लंबाई आवश्यक है, जब स्ट्रिंग लंबाई में भिन्न हो सकती हैं तो edit distance का उपयोग करें।

अक्सर पूछे जाने वाले प्रश्न

दोनों इनपुट समान लंबाई के क्यों होने चाहिए?
Hamming दूरी केवल समान-लंबाई अनुक्रमों के लिए परिभाषित है — यह एक की स्थिति i की तुलना दूसरे की स्थिति i से करती है। यदि लंबाई भिन्न हो तो कोई मानक संरेखण नहीं होता, इसलिए टूल दोनों लंबाई के साथ एक त्रुटि बताता है। भिन्न लंबाई वाले इनपुट के लिए, इसके बजाय Levenshtein (edit) दूरी का उपयोग करें।
बाइनरी मोड क्या गिनता है?
यह वैलिडेट करता है कि दोनों इनपुट समान लंबाई के 0 और 1 की स्ट्रिंग हैं, फिर उन बिट स्थानों को गिनता है जो भिन्न हैं — जो दो बिटस्ट्रिंग के XOR के population count (सेट बिट्स की संख्या) के समान है।
हेक्स मोड दूरी की गणना कैसे करता है?
प्रत्येक हेक्स अंक एक nibble (4 बिट्स) है। टूल दोनों मानों को अंक-दर-अंक XOR करता है और सभी nibble में सेट बिट्स को जोड़ता है, जो बिट-स्तरीय Hamming दूरी देता है। सामान्यीकरण के लिए उपयोग की जाने वाली लंबाई कुल बिट गिनती है, यानी हेक्स अंकों की संख्या गुणा चार।
सामान्यीकृत दूरी क्या है?
यह कच्ची दूरी को तुलना लंबाई से भाग देने पर मिलने वाला मान है, 0 (समान) और 1 (हर स्थान भिन्न) के बीच का। यह आपको भिन्न लंबाई वाले इनपुट में मिसमैच दरों की तुलना समान 0–1 पैमाने पर करने देता है।

और टूल