यह क्या करता है
यह टूल किसी टेक्स्ट के पीछे के बाइट्स दिखाता है और बाइट्स को वापस टेक्स्ट में बदलता है। कोई शब्द टाइप करें और उसे बाइनरी (01001000 01101001), हेक्साडेसिमल (48 69), डेसिमल (72 105) या ऑक्टल (110 151) में देखें। किसी packet dump, debugger या होमवर्क से बाइट्स की स्ट्रिंग पेस्ट करें और उसे फिर से टेक्स्ट के रूप में पढ़ें।
सारा कन्वर्ज़न UTF-8 से होकर जाता है, इसलिए यह सिर्फ़ सादे ASCII के लिए नहीं, हर भाषा और इमोजी के लिए काम करता है। इससे यह समझना आसान हो जाता है कि 你好 छह बाइट लंबा क्यों है या डेटाबेस कॉलम में एक इमोजी चार बाइट क्यों गिना जाता है।
कैसे इस्तेमाल करें
- एनकोड करने के लिए टेक्स्ट → बाइट्स या डिकोड करने के लिए बाइट्स → टेक्स्ट चुनें।
- संख्या का फ़ॉर्मैट चुनें: बाइनरी, hex, डेसिमल या ऑक्टल।
- एनकोड करते समय बाइट्स के बीच सेपरेटर (स्पेस, कोई नहीं, कॉमा या नई लाइन) चुनें, और यह कि hex अक्षर बड़े हों या नहीं।
- अपना इनपुट टाइप या पेस्ट करें। नतीजा टाइप करते-करते अपडेट होता है और कॉपी या डाउनलोड किया जा सकता है।
डिकोडिंग के नियम
डिकोड करते समय टूल लेआउट को लेकर लचीला है:
- बाइट्स स्पेस, कॉमा, सेमीकोलन या लाइन ब्रेक से अलग हो सकते हैं, किसी भी मिश्रण में।
- आम प्रीफ़िक्स हटा दिए जाते हैं: hex के लिए
0x,\xऔर%, बाइनरी के लिए0b, ऑक्टल के लिए0oया\। - बिना सेपरेटर वाली लंबी स्ट्रिंग तय चौड़ाई के बाइट्स में बाँटी जाती है: बाइनरी के लिए 8 अंक, hex के लिए 2 और ऑक्टल या डेसिमल के लिए 3।
- 255 से बड़ी वैल्यू या फ़ॉर्मैट से बाहर का अंक उसकी लाइन और कॉलम के साथ रिपोर्ट होता है।
उदाहरण
Hi 你好 को बाइनरी में एनकोड करने पर नौ बाइट्स मिलते हैं: Hi के लिए दो, स्पेस के लिए एक, और हर चीनी अक्षर के लिए तीन। यही टेक्स्ट hex में 48 69 20 e4 bd a0 e5 a5 bd है, जो ठीक वही है जो आप hex एडिटर में या URL में %E4%BD%A0 के रूप में देखेंगे।
यह कब काम आता है
डेवलपर इसका इस्तेमाल यह जाँचने के लिए करते हैं कि टेक्स्ट डिस्क पर कैसे स्टोर होता है या नेटवर्क पर कैसे भेजा जाता है, बाइट्स और अक्षरों में स्ट्रिंग की लंबाई की तुलना करने के लिए, और mojibake (बिगड़े हुए अक्षर) डिबग करने के लिए। छात्र इससे हाथ से बाइनरी और हेक्साडेसिमल का अभ्यास करते हैं और अपने जवाब जाँचते हैं।
अक्सर पूछे जाने वाले सवाल
› टूल कौन-सी कैरेक्टर एनकोडिंग इस्तेमाल करता है?
UTF-8, वेब की एनकोडिंग। ASCII अक्षर एक-एक बाइट लेते हैं, accented अक्षर आमतौर पर दो, और चीनी, जापानी या कोरियाई अक्षर तीन। इमोजी चार बाइट लेते हैं।
› क्या मैं 0x या \x प्रीफ़िक्स वाले बाइट्स पेस्ट कर सकता हूँ?
हाँ। डिकोड करते समय hex के लिए 0x, \x और %, बाइनरी के लिए 0b और ऑक्टल के लिए 0o जैसे प्रीफ़िक्स हटा दिए जाते हैं, और स्पेस, कॉमा, सेमीकोलन और लाइन ब्रेक सभी सेपरेटर के रूप में काम करते हैं।
› मुझे यह एरर क्यों मिलता है कि बाइट्स मान्य UTF-8 नहीं हैं?
कुछ बाइट सीक्वेंस UTF-8 टेक्स्ट में नहीं आ सकते, जैसे अकेला FF बाइट या बीच में कटा हुआ multi-byte अक्षर। जाँचें कि आपने हर बाइट कॉपी किया है और सही फ़ॉर्मैट चुना है।
› क्या मेरा टेक्स्ट अपलोड होता है?
नहीं। एनकोडिंग और डिकोडिंग आपके ब्राउज़र में चलती है।