IDN होमोग्राफ़ हमले कैसे काम करते हैं और उन्हें कैसे पहचानें
अंतरराष्ट्रीयकृत डोमेन नाम (IDN) कई लिपियों के अक्षरों की अनुमति देते हैं। होमोग्राफ़ हमले में कोई ऐसा डोमेन पंजीकृत करता है जिसमें लैटिन अक्षरों की जगह किसी दूसरी लिपि के एक जैसे दिखने वाले अक्षर रखे जाते हैं, ताकि लिंक भरोसेमंद पते जैसा दिखे पर किसी दूसरे डोमेन पर ले जाए।
हल किया हुआ उदाहरण
- इनपुट
- еxаmple.com
- मिली लिपियाँ
- सिरिलिक (Cyrl), लैटिन (Latn)
- चिह्नित वर्ण
- 2
| स्थान | वर्ण | कोड पॉइंट | लिपि | प्रतिस्थापन | नियम |
|---|---|---|---|---|---|
| 0 | е | U+0435 | सिरिलिक | e | भ्रामक वर्ण तालिका |
| 2 | а | U+0430 | सिरिलिक | a | भ्रामक वर्ण तालिका |
- Punycode (जिसे DNS खोजता है)
- xn--xmple-4ve7a.com
- सख्त ASCII फ़ॉलबैक
- example.com
यह कैसे काम करता है
- DNS केवल ASCII के साथ काम करता है, इसलिए अन्य वर्णों वाला लेबल xn-- से शुरू होने वाले Punycode में बदला जाता है। Punycode रूप ही असली नाम है: अगर कोई जाना-पहचाना दिखने वाला पता xn--… बन जाता है, तो वह वह डोमेन नहीं है जो दिखता है।
- जब कोई लेबल लिपियों को मिलाता है तो ब्राउज़र आम तौर पर Punycode रूप दिखाते हैं, लेकिन ईमेल क्लाइंट, चैट ऐप और दस्तावेज़ अक्सर भ्रामक यूनिकोड रूप दिखाते हैं, और पूरी तरह एक ही हमशक्ल लिपि में लिखा लेबल पकड़ में आए बिना निकल सकता है।
- किसी डोमेन की जाँच के लिए उसे डिटेक्टर में चिपकाएँ। कोई चिह्नित वर्ण, एक लेबल में एक से अधिक लिपियाँ, या मूल से अलग साफ़ किया गया रूप दिखे, तो लिंक के बजाय पता खुद टाइप करें या बुकमार्क से खोलें।
रूपांतरण सर्वोत्तम प्रयास है: मैप किए गए कन्फ्यूज़ेबल और एनएफकेसी फोल्डिंग नियतात्मक हैं, लेकिन कुछ वैध यूनिकोड को चिह्नित नहीं किया जाएगा।
आपका पाठ
पेस्ट करें या टाइप करें - जैसे ही आप टाइप करते हैं परिणाम अपडेट हो जाते हैं (लंबे इनपुट के लिए हल्के ढंग से डिबाउंस)।
11 वर्ण स्कैन किए गए
2 संदिग्ध
सख्त ASCII फ़ॉलबैक
मूल (संदिग्ध पात्र चिन्हित)
मूल दृश्य में संदिग्ध पात्रों को रेखांकित किया गया है और उन्हें "संदिग्ध" लेबल दिया गया है। रंग को हाइलाइट करने के अलावा.
suspicious character еxsuspicious character аmple.com
साफ़ आउटपुट
वर्ण विश्लेषण
| सूचकांक (0-आधारित) | मूल | प्रतिस्थापन | कोड बिंदु | कारण |
|---|---|---|---|---|
| 0 | е | e | U+0435 | Non-ASCII confusable mapped to a safer Latin ASCII equivalent. |
| 1 | x | x | U+0078 | Not flagged as a confusable or compatibility character. |
| 2 | а | a | U+0430 | Non-ASCII confusable mapped to a safer Latin ASCII equivalent. |
| 3 | m | m | U+006D | Not flagged as a confusable or compatibility character. |
| 4 | p | p | U+0070 | Not flagged as a confusable or compatibility character. |
| 5 | l | l | U+006C | Not flagged as a confusable or compatibility character. |
| 6 | e | e | U+0065 | Not flagged as a confusable or compatibility character. |
| 7 | . | . | U+002E | Not flagged as a confusable or compatibility character. |
| 8 | c | c | U+0063 | Not flagged as a confusable or compatibility character. |
| 9 | o | o | U+006F | Not flagged as a confusable or compatibility character. |
| 10 | m | m | U+006D | Not flagged as a confusable or compatibility character. |