यूनिकोड एस्केप परिवर्तक क्या है?

Unicode Escape Converter एस्केप सीक्वेंस (जैसे \u0041) को पढ़ने योग्य अक्षरों में बदलता है और उल्टा भी करता है। JavaScript \uXXXX, HTML एंटिटीज़, Python नोटेशन और URL प्रतिशत-एन्कोडिंग को सपोर्ट करता है, जिससे i18n स्ट्रिंग्स डीबग करना, API रिस्पॉन्स डिकोड करना या कोड के लिए टेक्स्ट तैयार करना आसान हो जाता है।

कन्वर्टर छह एस्केप फ़ॉर्मेट देता है। JavaScript शैली का \uXXXX बेसिक मल्टीलिंगुअल प्लेन कवर करता है, और इमोजी या दुर्लभ CJK अक्षरों के लिए सरोगेट जोड़ों का उपयोग करता है। JavaScript ES6 का \u{X} किसी भी कोड पॉइंट को एक ही अनुक्रम में लिखता है, इसलिए आधुनिक कोड में सरोगेट जोड़ों की ज़रूरत नहीं पड़ती। HTML संख्यात्मक एंटिटी &#xHHHH; HTML मार्कअप और ईमेल में सीधे काम करती हैं। CSS शैली \HHHH स्टाइलशीट की content प्रॉपर्टी में लिखी जाती है। Python बेसिक प्लेन के लिए \uXXXX और उससे ऊपर के लिए \UXXXXXXXX का उपयोग करता है, इसलिए आउटपुट सीधे Python स्ट्रिंग लिटरल में पेस्ट हो जाता है। URL प्रतिशत-एन्कोडिंग %XX हर UTF-8 बाइट को एस्केप करती है और क्वेरी स्ट्रिंग व पाथ सेगमेंट के लिए उपयुक्त है। एक स्विच से हेक्स अंकों को बड़ा या छोटा रूप दिया जा सकता है, और केवल नॉन-ASCII एस्केप करने वाला मोड प्रिंट होने वाले ASCII को छेड़े बिना छोड़ देता है ताकि JSON और i18n फ़ाइलें पढ़ने में आसान बनी रहें। मैपिंग पैनल हर ग्लिफ का कोड पॉइंट, आधिकारिक Unicode नाम, कच्चे UTF-8 बाइट, ब्लॉक और श्रेणी दिखाता है, और किसी भी कार्ड पर क्लिक करके आप सिर्फ़ उस अक्षर का एस्केप कॉपी कर सकते हैं।

उपयोग कैसे करें

  1. स्टेप 1 — इनपुट में यूनिकोड एस्केप सीक्वेंस पेस्ट करें (जैसे \u0048\u0065\u006C\u006C\u006F) ताकि उन्हें पढ़ने योग्य कैरेक्टर में डिकोड किया जा सके।
  2. स्टेप 2 — या प्लेन टेक्स्ट डालें (जैसे Hello) ताकि उसे आपके चुने हुए फ़ॉर्मेट में यूनिकोड एस्केप सीक्वेंस में एनकोड किया जा सके।
  3. स्टेप 3 — एस्केप फ़ॉर्मेट चुनें (JavaScript \uXXXX, HTML &#xHHHH;, CSS \HHHH, Python \U या URL %XX) और रिज़ल्ट कॉपी करें। मैपिंग पैनल हर अक्षर का नाम बताता है और उसके UTF-8 बाइट, ब्लॉक व श्रेणी का विवरण देता है; एक एस्केप कॉपी करने के लिए कार्ड पर क्लिक करें।

कब उपयोग करें

  • जब API प्रतिक्रिया \u00E9 जैसा लौटाए और आपको असली अक्षर सत्यापित करना हो।
  • जब हिंदी या किसी और non-ASCII पाठ को JSON या JavaScript स्रोत कोड में बदलकर ASCII-only पाइपलाइन में सुरक्षित भेजना हो।
  • जब कॉपी की हुई स्ट्रिंग में छुपे हुए ज़ीरो-विड्थ स्पेस या BOM जैसे अदृश्य Unicode अक्षर खोजने हों।

परिणाम

एक API \u0041\u006E\u0064\u0072\u00E9 रिटर्न करता है और आपको असली नाम चाहिए। इसे पेस्ट करें और 'André' देखें — फिर अपना रिस्पॉन्स टेक्स्ट API पेलोड के लिए वापस एस्केप में बदलें।

अक्सर पूछे जाने वाले प्रश्न

कुछ अक्षर JavaScript में दो \uXXXX के रूप में क्यों आते हैं?
U+FFFF से ऊपर के कोडपॉइंट (इमोजी, प्राचीन लिपियाँ, दुर्लभ CJK अक्षर) बेसिक मल्टीलिंगुअल प्लेन से बाहर होते हैं। JavaScript इन्हें UTF-16 सरोगेट जोड़ी के रूप में दिखाता है, इसलिए रॉकेट इमोजी \uD83D\uDE80 बनता है। ES2015 में \u{1F680} भी लिखा जा सकता है।
अपने कोड में कौन-सा एस्केप फ़ॉर्मेट इस्तेमाल करूँ?
JavaScript या JSON स्ट्रिंग में \uXXXX, खुले HTML मार्कअप में &#xHHHH;, CSS की content प्रॉपर्टी में \HHHH, और क्वेरी स्ट्रिंग व पाथ सेगमेंट के लिए URL %XX प्रतिशत-एन्कोडिंग। JSON \u{...} नोटेशन को नहीं पहचानता, इसलिए वहाँ हमेशा \uXXXX और सरोगेट जोड़ी इस्तेमाल करें।
एस्केप और HTML एंटिटी में अंतर क्या है?
दोनों एक ही Unicode कोडपॉइंट की ओर इशारा करते हैं। एस्केप (\u00E9) को लैंग्वेज रनटाइम (JavaScript, CSS, Python) पढ़ता है, जबकि HTML एंटिटी (é या é) को ब्राउज़र मार्कअप पार्स करते समय हैंडल करता है। संदर्भ बदलते ही ये एक-दूसरे की जगह नहीं ले सकते।
स्ट्रिंग में मौजूद अदृश्य Unicode अक्षर कैसे खोजें?
टेक्स्ट को पेस्ट करके encode मोड में जाएँ। मैपिंग टेबल हर कोडपॉइंट क्रम से दिखाती है: ज़ीरो-विड्थ स्पेस (U+200B), बाइट ऑर्डर मार्क (U+FEFF), नॉन-ब्रेकिंग स्पेस (U+00A0) जैसे अदृश्य अक्षर अपनी एस्केप के साथ साफ़ नज़र आ जाते हैं।
क्या टूल Python स्रोत के \u एस्केप भी डिकोड कर सकता है?
हाँ। Python के \u0041 और \U0001F680 का सिंटैक्स JavaScript के \uXXXX और \u{1F680} जैसा ही है। स्ट्रिंग का भीतर का भाग (बाहरी उद्धरण और r उपसर्ग हटाकर) पेस्ट करें, डिकोडर पढ़ने योग्य पाठ लौटा देगा।

संबंधित उपकरण