यह क्या करता है
HTML एंटिटी ऐसे कोड हैं जो कैरेक्टर्स को दर्शाते हैं, जैसे < के लिए < और é के लिए é। यह टूल टेक्स्ट को एंटिटी में escape करता है ताकि उसे वेब पेज के अंदर सुरक्षित रूप से दिखाया जा सके, और एंटिटी को वापस सादे टेक्स्ट में डिकोड करता है, जैसे जब आप किसी CMS या ईमेल टेम्पलेट से मार्कअप कॉपी करते हैं।
एनकोडिंग 2,000 से ज़्यादा नाम वाले रेफ़रेंस की पूरी HTML5 लिस्ट इस्तेमाल करती है, और डिकोडिंग नाम वाले, दशमलव (©) और हेक्साडेसिमल (©) रेफ़रेंस को ठीक वैसे ही समझती है जैसे ब्राउज़र।
कैसे इस्तेमाल करें
- टेक्स्ट या HTML को इनपुट बॉक्स में पेस्ट करें, कोई फ़ाइल अपलोड करें, या उदाहरण पर क्लिक करें।
- एनकोड या डिकोड चुनें।
- एनकोड करते समय चुनें कि कितना एनकोड करना है:
- सिर्फ़ & < > ” ’: टेक्स्ट को HTML या attribute में डालने के लिए न्यूनतम ज़रूरी।
- साथ में non-ASCII, नाम वाली: é, © और — जैसे कैरेक्टर्स को भी नाम वाली एंटिटी में बदलता है, और जिनका कोई नाम नहीं उन्हें संख्या वाले रेफ़रेंस में।
- साथ में non-ASCII, संख्या वाली: वैसा ही, लेकिन हमेशा संख्या वाला (
é), जो वैलिड XML भी है। - जिसका भी नाम हो, सब:
.और/जैसे विराम चिह्नों को भी एनकोड करता है, जो तब उपयोगी है जब कोई सिस्टम उन कैरेक्टर्स को हटा देता है।
- परिणाम कॉपी या डाउनलोड करें। इनपुट के रूप में उपयोग करें से आप राउंड ट्रिप जाँचने के लिए इसे फिर से डिकोड कर सकते हैं।
उदाहरण
<p>Café & "crème brûlée"</p>
सिर्फ़ स्पेशल कैरेक्टर्स के साथ एनकोड करने पर बनता है
<p>Café & "crème brûlée"</p>
और non-ASCII नाम वाली एंटिटी के साथ बनता है
<p>Café & "crème brûlée"</p>
आम इस्तेमाल
ब्लॉग पर कोड स्निपेट दिखाना ताकि ब्राउज़र उसे रेंडर न करे, यूज़र का टेक्स्ट HTML ईमेल में डालना, &amp; जैसे दोहरी बार escape हुए टेक्स्ट को ठीक करना (एक बार डिकोड करें), या किसी फ़ाइल को ऐसे सिस्टम के लिए सुरक्षित बनाना जो सिर्फ़ ASCII स्वीकार करता है।
अक्सर पूछे जाने वाले सवाल
› HTML में कौन-से कैरेक्टर escape करना ज़रूरी है?
टेक्स्ट में & और < को escape करें। attribute वैल्यू के अंदर, वैल्यू को घेरने वाले कोट कैरेक्टर को भी escape करें। हर जगह & < > " और ' को escape करना, जो यहाँ डिफ़ॉल्ट है, हमेशा सुरक्षित है।
› नाम वाली एंटिटी इस्तेमाल करूँ या संख्या वाली?
दोनों हर मॉडर्न ब्राउज़र में काम करती हैं। é जैसी नाम वाली एंटिटी पढ़ने में आसान हैं; é जैसे संख्या वाले रेफ़रेंस XML में और उन पुराने पार्सर्स में भी काम करते हैं जो सिर्फ़ कुछ ही नाम जानते हैं। UTF-8 पेज पर आम तौर पर non-ASCII कैरेक्टर को एनकोड करने की ज़रूरत ही नहीं होती।
› क्या डिकोडिंग बिना सेमीकोलन वाली एंटिटी संभालती है?
हाँ। यह HTML स्पेसिफ़िकेशन को फ़ॉलो करती है, इसलिए बिना सेमीकोलन वाले © जैसे पुराने रूप वैसे ही डिकोड होते हैं जैसे ब्राउज़र करता। &foo; जैसे अनजान नाम बिना बदले छोड़ दिए जाते हैं।
› क्या XSS रोकने के लिए escape करना काफ़ी है?
HTML एलिमेंट्स और कोट किए गए attributes के अंदर रखे टेक्स्ट के लिए escaping सही बचाव है। यह script ब्लॉक, style ब्लॉक, event handler attributes या URL के अंदर अविश्वसनीय इनपुट को सुरक्षित नहीं बनाता, जिनके लिए संदर्भ के हिसाब से एनकोडिंग चाहिए।