HTML एंटिटी एनकोडर/डिकोडर क्या है?
HTML एंटिटी एन्कोडर/डिकोडर <, >, & और उद्धरण जैसे विशेष अक्षरों को उनके HTML एंटिटी समकक्षों में बदलता है (और वापस भी)। यह HTML में उपयोगकर्ता कंटेंट एम्बेड करते समय XSS कमजोरियों को रोकता है और विशेष अक्षरों की डिस्प्ले समस्याओं को ठीक करता है।
एन्कोडर <, >, &, ", ' जैसे अक्षरों और किसी भी यूनिकोड कोडपॉइंट को नामित इकाइयों (&, <), दशमलव संख्यात्मक संदर्भों (&), या हेक्स संख्यात्मक संदर्भों (&) में बदलता है। क्षेत्र चयनकर्ता आपको केवल पाँच आरक्षित अक्षर, सभी विशेष अक्षर, या हर गैर-ASCII अक्षर एन्कोड करने देता है। डिकोडिंग तीनों में से किसी भी प्रारूप को उलट देती है। उपयोगकर्ता इनपुट को HTML आउटपुट के लिए सेनिटाइज़ करने या HTML ईमेल निर्यात से पाठ पुनः प्राप्त करने में सहायक।
उपयोग कैसे करें
- चरण 1 — विशेष अक्षरों या HTML एंटिटी वाला टेक्स्ट पेस्ट करें।
- चरण 2 — अक्षरों को एंटिटी में बदलने के लिए Encode चुनें, या एंटिटी को वापस अक्षरों में बदलने के लिए Decode चुनें।
- चरण 3 — एक प्रारूप (नामित, दशमलव या हेक्स) और क्षेत्र चुनें ताकि एन्कोडिंग की तीव्रता तय हो सके।
कब उपयोग करें
- CMS में कोड उदाहरण चिपकाते समय < और > को टैग समझकर गायब होने से रोकना।
- HTML मेल या स्क्रैप किए पन्ने का टेक्स्ट, जिसमें अब भी — और पड़ा हो, साफ करना।
- सर्वर टेम्पलेट में डालने से पहले यूज़र इनपुट को एस्केप करना ताकि XSS रुक जाए।
परिणाम
आपको <div class="hero"> कोड स्निपेट को HTML पैराग्राफ में दिखाना है। इसे <div class="hero"> में एन्कोड करें ताकि डिवाइस इसे मार्कअप के रूप में समझने की बजाय टेक्स्ट रेंडर करे।
अक्सर पूछे जाने वाले प्रश्न
- नामांकित और संख्यात्मक HTML एंटिटी में फर्क क्या है?
- नामांकित एंटिटी पढ़ने योग्य संक्षेप होती हैं (© का मतलब ©)। संख्यात्मक एंटिटी सीधे Unicode कोडपॉइंट लिखती हैं (© या ©)। संख्यात्मक हर Unicode अक्षर के लिए चलती है; नामांकित केवल HTML5 स्पेक के लगभग 250 अक्षरों तक सीमित है।
- क्या हर विशेष अक्षर को एनकोड करना ज़रूरी है, या कुछ ही चलते हैं?
- HTML बॉडी टेक्स्ट में आपको केवल & < > और एट्रिब्यूट वैल्यू में उपयोग की गई कोट को एन्कोड करना होता है। JavaScript या URL संदर्भों में नियम बदल जाते हैं। क्षेत्र चयनकर्ता तीन विकल्प देता है: केवल आरक्षित — पाँच XSS-महत्वपूर्ण अक्षरों के लिए, सभी विशेष — टाइपोग्राफी सहित आरक्षित अक्षरों के लिए, या सभी गैर-ASCII — सबसे व्यापक कवरेज के लिए।
- क्या एनकोडिंग कॉपी-पेस्ट या स्क्रीन रीडर तोड़ देती है?
- नहीं। ब्राउज़र रेंडर से पहले एंटिटी डिकोड कर देता है, इसलिए यूज़र को मूल अक्षर ही दिखता है और वही कॉपी होता है। स्क्रीन रीडर को भी डिकोड किया रूप मिलता है। एंटिटी मार्कअप के ट्रांसपोर्ट फॉर्मेट हैं, अंतिम आउटपुट नहीं।
- क्या केवल HTML एंटिटी एनकोडिंग XSS रोकने के लिए काफी है?
- HTML बॉडी में रखे टेक्स्ट के लिए हाँ। एट्रिब्यूट में मूल्य को कोट में रखना और उसी कोट को भी एनकोड करना पड़ता है। JavaScript, CSS और URL की अपनी एस्केप नियम होते हैं; एनकोडिंग पहली परत है, पूरा बचाव नहीं।
- कुछ एंटिटी &#x से और कुछ केवल &# से क्यों शुरू होती हैं?
- &#x के बाद हेक्साडेसिमल कोडपॉइंट आता है, &# के बाद दशमलव। दोनों एक ही अक्षर बताते हैं, यानी © और © दोनों © हैं। हेक्स Unicode तालिकाओं की U+ शैली से मेल खाता है और ऊँचे कोड को छोटा लिख पाता है।
संबंधित उपकरण
तुकबंदी खोजक
किसी भी शब्द के लिए सटीक और निकट तुकबंदी खोजें
एनाग्राम सॉल्वर
किसी भी शब्द के सभी वैध एनाग्राम खोजें
यूनिकोड लुकअप
नाम या कोड से यूनिकोड खोजें
URL एन्कोडर/डिकोडर
URL को तुरंत एन्कोड और डीकोड करें
NATO फोनेटिक अल्फाबेट
टेक्स्ट को NATO फोनेटिक अल्फाबेट में बदलें
पैराग्राफ काउंटर
अपने टेक्स्ट में पैराग्राफ गिनें