टूल
गाइड

ASCII वर्ण तालिका

संदर्भ

128 मानक ASCII (0–127) कोड बिंदुओं की संदर्भ: दशमलव, हेक्स, ग्लिफ़, नाम और C-शैली एस्केप, खोज सहित।

100% क्लाइंट-साइड कोई बैकएंड नहीं
दशमलव हेक्स वर्ण नाम एस्केप श्रेणी
इस पृष्ठ पर

ASCII वर्ण संदर्भ क्या है?#

ASCII वह 7-बिट वर्ण समूह है जो वेब पर लगभग हर टेक्स्ट प्रारूप को आधार देता है। यह ठीक 128 कोडपॉइंट परिभाषित करता है — संख्याएँ 0 से 127 — और प्रत्येक को एक अर्थ देता है: कोई मुद्रण योग्य ग्लिफ़ (अक्षर, अंक, विरामचिह्न), एक नियंत्रण संकेत (टैब, लाइन फ़ीड, एस्केप, वह घंटी जो कभी टेलिटाइप पर एक भौतिक घंटी बजाती थी), या बीच का स्पेस वर्ण। हर बाइट जिसका मान 128 से कम है वह एक ASCII वर्ण है, और क्योंकि UTF-8 को जानबूझकर पहले 128 कोडपॉइंट हेतु ASCII के साथ ओवरलैप करने के लिए डिज़ाइन किया गया था, एक केवल-ASCII दस्तावेज़ स्वतः ही एक वैध UTF-8 दस्तावेज़ है। इसीलिए इस पृष्ठ के अक्षर, आपके कीबोर्ड की कुंजी, और JSON फ़ाइल के बाइट — सभी तल पर ASCII हैं।

छोटा होने के बावजूद, ASCII उन विवरणों से भरा है जो डेवलपर्स को बार-बार चाहिए: स्पेस का दशमलव कोड क्या है (32), Escape कुंजी का hex क्या है (1B), कौन-सा C एस्केप टैब लिखता है (\t), मुद्रण योग्य परास कहाँ से शुरू होकर समाप्त होता है। यह पृष्ष सभी 128 कोडपॉइंट की एक खोज योग्य तालिका है उनके दशमलव मान, hex मान, ग्लिफ़, नाम, C-शैली एस्केप, और श्रेणी के साथ।

इसका उपयोग कैसे करें#

  1. जैसा याद है वैसे खोजें। खोजें बॉक्स कई रूप स्वीकार करता है, सबसे-विशिष्ट पहले आज़माया जाता है:
    • उपसर्ग या प्रत्यय वाला hex — 0x41 या 41h hex कोडपॉइंट द्वारा मिलाता है (उपसर्ग मिलान स्वीकार्य, इसलिए 0x4 हर कोडपॉइंट जो 4 से शुरू होता है सूचीबद्ध करता है)।
    • सादा दशमलव — 65 उसी सटीक कोडपॉइंट पर कूदता है।
    • एकल वर्ण — A टाइप करें और आपको कोडपॉइंट 65 मिलता है (केस-संवेदनशील, इसलिए A और a भिन्न पंक्तियाँ हैं)।
    • कोई शब्द — tab, escape, null नाम, ग्लिफ़, या एस्केप स्ट्रिंग के विरुद्ध मिलाता है।
  2. पंक्ति पढ़ें। कॉलम हैं दशमलव (दशमलव कोडपॉइंट), हेक्स (दो-अंकीय hex), वर्ण (शाब्दिक ग्लिफ़, गैर-मुद्रण योग्य नियंत्रण हेतु रिक्त), नाम (मानक नाम जैसे “Line Feed”), एस्केप (C-शैली रूप यदि कोई हो, जैसे \n), और श्रेणी (control, whitespace, या printable)।

मुख्य विशेषताएँ#

  • सभी 128 कोडपॉइंट। पूर्ण 7-बिट परास, 0 से 127 — कुछ भी छोड़ा नहीं, कुछ भी अतिरिक्त नहीं।
  • तीन श्रेणियाँ जो विनिर्देश के विभाजन से मेल खाती हैं। 32 नियंत्रण वर्ण (0–31) साथ में DEL (127), एकल श्वेत-स्थान वर्ण (स्पेस, 32), और 94 मुद्रण योग्य वर्ण (33–126) — श्रेणी द्वारा रंग-कोडित ताकि संरचना एक नज़र में दिखे।
  • C-शैली एस्केप जहाँ मौजूद हों। \0, \a, \b, \t, \n, \v, \f, \r, \e उन नियंत्रणों हेतु जिनका समर्पित रूप है; स्पेस हेतु \s; DEL हेतु \x7F। उपयोगी जब आपको संख्या के बजाय एस्केप चाहिए।
  • लचीली खोज। दशमलव, hex (0x या h सहित), एकल वर्ण, या मुक्त टेक्स्ट — जो भी रूप आपके पास हाथ में है।
  • ऑफ़लाइन चलता है, ब्राउज़र में। पूरी तालिका पृष्ठ के साथ आती है; फ़िल्टरिंग तत्काल और स्थानीय है।

विस्तृत उदाहरण#

कुछ रोज़मर्रा के लुकअप, सभी खोज से पाए:

  • कैपिटल A — A, या 65, या 0x41 खोजें। पंक्ति पढ़ती है: दशमलव 65, हेक्स 41, वर्ण A, नाम A, एस्केप (रिक्त, क्योंकि मुद्रण योग्य वर्णों का कोई C एस्केप नहीं), श्रेणी printable।
  • टैब — tab, या 9, या \t (मुक्त-टेक्स्ट पास एस्केप स्ट्रिंग से मेल खाता है) खोजें। दशमलव 9, हेक्स 09, वर्ण रिक्त (एक नियंत्रण, मुद्रण योग्य नहीं), नाम Horizontal Tab, एस्केप \t, श्रेणी control।
  • लाइन फ़ीड (newline) — 10 या Line Feed खोजें। दशमलव 10, हेक्स 0A, एस्केप \n। इसका पड़ोसी 13 पर Carriage Return (\r) है; साथ में ये \r\n बनाम \n लाइन-समाप्ति प्रश्न समझाते हैं (FAQ देखें)।
  • Escape कुंजी — Escape या 27 खोजें। दशमलव 27, हेक्स 1B, एस्केप \e।

परास पर एक नोट: मुद्रण योग्य वर्ण 32 (स्पेस) से 126 (टिल्ड ~) तक चलते हैं। स्पेस के नीचे के 32 कोड (0–31) और कोड 127 (Delete) नियंत्रण वर्ण हैं — वे ग्लिफ़ प्रिंट नहीं करते; वे टर्मिनल या टेक्स्ट स्ट्रीम को कुछ संकेत करते हैं। वह सीमा जानना सबसे उपयोगी ASCII तथ्य है: 32 से 126 तक का कोई भी बाइट एक दृश्य (या स्पेस) वर्ण है, 32 से नीचे या 127 पर कुछ भी एक नियंत्रण है।

अक्सर पूछे जाने वाले प्रश्न#

केवल 128 वर्ण क्यों?#

ASCII को एक 7-बिट कोड के रूप में डिज़ाइन किया गया था, और 2 की घात 7 में 128 है — यह पूर्ण परास है, 0 से 127। इस समूह के बाहर के वर्ण (उच्चारण वाले अक्षर, सिरिलिक, CJK, इमोजी) ASCII नहीं हैं; वे Latin-1 जैसे विस्तारित समूहों में या, आधुनिक वेब पर, UTF-8 के रूप में कूटबद्ध Unicode में आते हैं। सुविधाजनक रूप से, UTF-8 पहले 128 कोडपॉइंट को ASCII के समान ही कूटबद्ध करता है, इसलिए शुद्ध-ASCII टेक्स्ट मुफ़्त में वैध UTF-8 है।

\r\n या \n — कौन-सा newline?#

दोनों मौजूद हैं, और वे भिन्न कोडपॉइंट हैं। \n लाइन फ़ीड है (दशमलव 10); \r कैरिज रिटर्न है (दशमलव 13)। Windows पुरानी टेलिटाइप परंपरा का पालन करता है और दोनों को एक साथ (\r\n) लाइन समाप्त करने हेतु उपयोग करता है; Unix और आधुनिक Mac केवल \n उपयोग करते हैं। इसीलिए किसी सख्त Unix एडिटर में खोली गई Windows टेक्स्ट फ़ाइल लाइन अंत में ^M कलाकृतियाँ दिखा सकती है, और इसीलिए Git में core.autocrlf सेटिंग्स हैं ही।

0x41 और 41h में क्या अंतर है?#

कुछ नहीं — वे उसी hex संख्या के दो सामान्य अंकन हैं। 0x41 C/Java/JavaScript उपसर्ग शैली है; 41h असेंबली-भाषा प्रत्यय शैली है। यह संदर्भ दोनों स्वीकार करता है, आगे के अक्षरों सहित या बिना, इसलिए आप जो भी रूप आपका स्रोत उपयोग करता है चिपका सकते हैं।

कोडपॉइंट 0 क्या है?#

यह Null है — सभी-शून्य बाइट। C में यह स्ट्रिंग्स समाप्त करता है (“null terminator”); कई प्रोटोकॉल में यह आरक्षित या निषिद्ध है; एक वर्ण के रूप में यह कुछ प्रिंट नहीं करता और तालिका इसे एस्केप \0 के साथ control के अंतर्गत सूचीबद्ध करती है। यह अंक शून्य (दशमलव 48) और स्पेस वर्ण (दशमलव 32) से भिन्न है, जो भ्रम का सामान्य स्रोत है।