डोमेन, उपयोगकर्ता नाम और संदेशों में होमोग्लिफ़ पहचानें
होमोग्लिफ़ ऐसा वर्ण है जो किसी दूसरे, अधिक परिचित वर्ण जैसा दिखता है: सिरिलिक а (U+0430) और लैटिन a (U+0061) अधिकांश फ़ॉन्ट में एक जैसे दिखते हैं, पर उनके कोड पॉइंट अलग हैं। डिटेक्टर हर वर्ण की जाँच करता है और हर नकली वर्ण को उसके स्थान, कोड पॉइंट, यूनिकोड लिपि और उस वर्ण के साथ दिखाता है जिसकी वह नकल करता है।
हल किया हुआ उदाहरण
- इनपुट
- pаypаl.com / Αdmіn
- मिली लिपियाँ
- लैटिन (Latn), सिरिलिक (Cyrl), यूनानी (Grek)
- चिह्नित वर्ण
- 4
| स्थान | वर्ण | कोड पॉइंट | लिपि | प्रतिस्थापन | नियम |
|---|---|---|---|---|---|
| 1 | а | U+0430 | सिरिलिक | a | भ्रामक वर्ण तालिका |
| 4 | а | U+0430 | सिरिलिक | a | भ्रामक वर्ण तालिका |
| 13 | Α | U+0391 | यूनानी | A | भ्रामक वर्ण तालिका |
| 16 | і | U+0456 | सिरिलिक | i | भ्रामक वर्ण तालिका |
- पठनीय यूनिकोड को सुरक्षित रखें
- paypal.com / Admin
यह कैसे काम करता है
- हर वर्ण को सिरिलिक, ग्रीक, लैटिन रूपांतरों और फ़ुल-विड्थ वर्णों के आम हमशक्लों की अंतर्निहित तालिका से मिलाया जाता है। मेल मिलने पर वर्ण को उस ASCII अक्षर, अंक या विराम चिह्न के साथ चिह्नित किया जाता है जिसकी वह नकल करता है।
- जो वर्ण तालिका में नहीं हैं, उन पर यूनिकोड NFKC सामान्यीकरण लागू होता है। यदि NFKC उन्हें बदल देता है, जैसा फ़ुल-विड्थ अक्षरों और fi जैसे संयुक्ताक्षरों के साथ होता है, तो उन्हें संगतता रूप के रूप में चिह्नित किया जाता है।
- स्थान यूनिकोड कोड पॉइंट में 0 से गिने जाते हैं। जिस शब्द में लैटिन अक्षर सिरिलिक या ग्रीक अक्षरों के साथ मिले हों, वह गंभीर चेतावनी का संकेत है, क्योंकि असली शब्द बीच में शायद ही कभी लिपि बदलते हैं।
रूपांतरण सर्वोत्तम प्रयास है: मैप किए गए कन्फ्यूज़ेबल और एनएफकेसी फोल्डिंग नियतात्मक हैं, लेकिन कुछ वैध यूनिकोड को चिह्नित नहीं किया जाएगा।
आपका पाठ
पेस्ट करें या टाइप करें - जैसे ही आप टाइप करते हैं परिणाम अपडेट हो जाते हैं (लंबे इनपुट के लिए हल्के ढंग से डिबाउंस)।
18 वर्ण स्कैन किए गए
4 संदिग्ध
पठनीय यूनिकोड को सुरक्षित रखें
मूल (संदिग्ध पात्र चिन्हित)
मूल दृश्य में संदिग्ध पात्रों को रेखांकित किया गया है और उन्हें "संदिग्ध" लेबल दिया गया है। रंग को हाइलाइट करने के अलावा.
psuspicious character аypsuspicious character аl.com / suspicious character Αdmsuspicious character іn
साफ़ आउटपुट
वर्ण विश्लेषण
| सूचकांक (0-आधारित) | मूल | प्रतिस्थापन | कोड बिंदु | कारण |
|---|---|---|---|---|
| 0 | p | p | U+0070 | Not flagged as a confusable or compatibility character. |
| 1 | а | a | U+0430 | Non-ASCII confusable mapped to a safer Latin ASCII equivalent. |
| 2 | y | y | U+0079 | Not flagged as a confusable or compatibility character. |
| 3 | p | p | U+0070 | Not flagged as a confusable or compatibility character. |
| 4 | а | a | U+0430 | Non-ASCII confusable mapped to a safer Latin ASCII equivalent. |
| 5 | l | l | U+006C | Not flagged as a confusable or compatibility character. |
| 6 | . | . | U+002E | Not flagged as a confusable or compatibility character. |
| 7 | c | c | U+0063 | Not flagged as a confusable or compatibility character. |
| 8 | o | o | U+006F | Not flagged as a confusable or compatibility character. |
| 9 | m | m | U+006D | Not flagged as a confusable or compatibility character. |
| 10 | U+0020 | Not flagged as a confusable or compatibility character. | ||
| 11 | / | / | U+002F | Not flagged as a confusable or compatibility character. |
| 12 | U+0020 | Not flagged as a confusable or compatibility character. | ||
| 13 | Α | A | U+0391 | Non-ASCII confusable mapped to a safer Latin ASCII equivalent. |
| 14 | d | d | U+0064 | Not flagged as a confusable or compatibility character. |
| 15 | m | m | U+006D | Not flagged as a confusable or compatibility character. |
| 16 | і | i | U+0456 | Non-ASCII confusable mapped to a safer Latin ASCII equivalent. |
| 17 | n | n | U+006E | Not flagged as a confusable or compatibility character. |