Unicode एन्कोडिंग नियम
छोटा टेक्स्ट इनपुट करें और प्रत्येक वर्ण के लिए Unicode कोड पॉइंट, दशमलव मान, संबंधित प्लेन और UTF-8 बाइट देखें; कोड पॉइंट श्रेणी की त्वरित संदर्शिका भी उपलब्ध रहेगी।
Unicode एन्कोडिंग नियम का उपयोग कैसे करें
Unicode और UTF-8 के परिणामों की गणना केवल वर्तमान ब्राउज़र में की जाती है; पाठ अपलोड या सहेजा नहीं जाएगा।
छोटा पाठ इनपुट करें
अधिकतम 64 Unicode स्केलर मान दर्ज करें; रिक्त स्थान, दोहराए गए अक्षर और मूल क्रम सभी सुरक्षित रखे जाएँगे।
कोड पॉइंट की जानकारी देखें
प्रत्येक वर्ण के लिए U+ संकेत, दशमलव कोड पॉइंट, Unicode प्लेन और बड़े अक्षरों में हेक्साडेसिमल UTF-8 बाइट देखें।
श्रेणी जाँचें
एकल-वर्ण खोज संबंधित कोड पॉइंट रेंज से जुड़ जाती है; आप TSV को कॉपी करके परिणाम साफ़ भी कर सकते हैं।
सीमाएँ और ध्यान देने योग्य बातें
- टूल Unicode स्केलर मानों के आधार पर विभाजित करता है और NFC, NFD आदि का सामान्यीकरण नहीं करता; संयोजित अनुक्रम कई पंक्तियों के रूप में सुरक्षित रहते हैं।
- सरोगेट आइटम U+D800–U+DFFF Unicode स्केलर मान नहीं हैं; पृथक सरोगेट आइटम को मान्य वर्ण एन्कोडिंग नहीं माना जाएगा।
- कोड पॉइंट और UTF-8 बाइट यह सुनिश्चित नहीं कर सकते कि फ़ॉन्ट में कोई ग्लिफ़ मौजूद है, और न ही वे GBK, Big5 जैसी पुरानी एन्कोडिंग खोजों का विकल्प हैं।
सामान्य प्रश्न
एक Emoji केवल एक पंक्ति में दिखाई देता है, फिर भी उसमें चार UTF-8 बाइट क्यों होते हैं?
यह Emoji एक पूरक प्लेन का Unicode स्केलर है, और UTF-8 इसे चार-बाइट अनुक्रम में दर्शाता है।
एक जैसे दिखने वाले अक्षरों के परिणाम अलग क्यों हो सकते हैं?
पूर्व-संयोजित वर्ण और संयोजन चिह्न वाले मूल वर्ण समान ग्लिफ़ जैसे दिखाई दे सकते हैं, लेकिन वे अलग-अलग Unicode स्केलर अनुक्रमों से बने होते हैं; यह टूल अपने-आप सामान्यीकरण नहीं करता।
U+ के बाद की संख्या किस संख्या पद्धति में है?
U+ संकेत-पद्धति हेक्साडेसिमल का उपयोग करती है; पृष्ठ साथ ही दशमलव कोड-बिंदु देता है, ताकि मिलान करके जाँच करना आसान हो।