ASCII वर्ण तालिका
संदर्भ128 मानक ASCII (0–127) कोड बिंदुओं की संदर्भ: दशमलव, हेक्स, ग्लिफ़, नाम और C-शैली एस्केप, खोज सहित।
| दशमलव | हेक्स | वर्ण | नाम | एस्केप | श्रेणी |
|---|
इस पृष्ठ पर
ASCII वर्ण संदर्भ क्या है?#
ASCII वह 7-बिट वर्ण समूह है जो वेब पर लगभग हर टेक्स्ट प्रारूप को आधार देता है। यह ठीक 128 कोडपॉइंट परिभाषित करता है — संख्याएँ 0 से 127 — और प्रत्येक को एक अर्थ देता है: कोई मुद्रण योग्य ग्लिफ़ (अक्षर, अंक, विरामचिह्न), एक नियंत्रण संकेत (टैब, लाइन फ़ीड, एस्केप, वह घंटी जो कभी टेलिटाइप पर एक भौतिक घंटी बजाती थी), या बीच का स्पेस वर्ण। हर बाइट जिसका मान 128 से कम है वह एक ASCII वर्ण है, और क्योंकि UTF-8 को जानबूझकर पहले 128 कोडपॉइंट हेतु ASCII के साथ ओवरलैप करने के लिए डिज़ाइन किया गया था, एक केवल-ASCII दस्तावेज़ स्वतः ही एक वैध UTF-8 दस्तावेज़ है। इसीलिए इस पृष्ठ के अक्षर, आपके कीबोर्ड की कुंजी, और JSON फ़ाइल के बाइट — सभी तल पर ASCII हैं।
छोटा होने के बावजूद, ASCII उन विवरणों से भरा है जो डेवलपर्स को बार-बार चाहिए: स्पेस का दशमलव कोड क्या है (32), Escape कुंजी का hex क्या है (1B), कौन-सा C एस्केप टैब लिखता है (\t), मुद्रण योग्य परास कहाँ से शुरू होकर समाप्त होता है। यह पृष्ष सभी 128 कोडपॉइंट की एक खोज योग्य तालिका है उनके दशमलव मान, hex मान, ग्लिफ़, नाम, C-शैली एस्केप, और श्रेणी के साथ।
इसका उपयोग कैसे करें#
- जैसा याद है वैसे खोजें। खोजें बॉक्स कई रूप स्वीकार करता है, सबसे-विशिष्ट पहले आज़माया जाता है:
- उपसर्ग या प्रत्यय वाला hex —
0x41या41hhex कोडपॉइंट द्वारा मिलाता है (उपसर्ग मिलान स्वीकार्य, इसलिए0x4हर कोडपॉइंट जो 4 से शुरू होता है सूचीबद्ध करता है)। - सादा दशमलव —
65उसी सटीक कोडपॉइंट पर कूदता है। - एकल वर्ण —
Aटाइप करें और आपको कोडपॉइंट 65 मिलता है (केस-संवेदनशील, इसलिएAऔरaभिन्न पंक्तियाँ हैं)। - कोई शब्द —
tab,escape,nullनाम, ग्लिफ़, या एस्केप स्ट्रिंग के विरुद्ध मिलाता है।
- उपसर्ग या प्रत्यय वाला hex —
- पंक्ति पढ़ें। कॉलम हैं दशमलव (दशमलव कोडपॉइंट), हेक्स (दो-अंकीय hex), वर्ण (शाब्दिक ग्लिफ़, गैर-मुद्रण योग्य नियंत्रण हेतु रिक्त), नाम (मानक नाम जैसे “Line Feed”), एस्केप (C-शैली रूप यदि कोई हो, जैसे
\n), और श्रेणी (control,whitespace, याprintable)।
मुख्य विशेषताएँ#
- सभी 128 कोडपॉइंट। पूर्ण 7-बिट परास, 0 से 127 — कुछ भी छोड़ा नहीं, कुछ भी अतिरिक्त नहीं।
- तीन श्रेणियाँ जो विनिर्देश के विभाजन से मेल खाती हैं। 32 नियंत्रण वर्ण (0–31) साथ में DEL (127), एकल श्वेत-स्थान वर्ण (स्पेस, 32), और 94 मुद्रण योग्य वर्ण (33–126) — श्रेणी द्वारा रंग-कोडित ताकि संरचना एक नज़र में दिखे।
- C-शैली एस्केप जहाँ मौजूद हों।
\0,\a,\b,\t,\n,\v,\f,\r,\eउन नियंत्रणों हेतु जिनका समर्पित रूप है; स्पेस हेतु\s; DEL हेतु\x7F। उपयोगी जब आपको संख्या के बजाय एस्केप चाहिए। - लचीली खोज। दशमलव, hex (
0xयाhसहित), एकल वर्ण, या मुक्त टेक्स्ट — जो भी रूप आपके पास हाथ में है। - ऑफ़लाइन चलता है, ब्राउज़र में। पूरी तालिका पृष्ठ के साथ आती है; फ़िल्टरिंग तत्काल और स्थानीय है।
विस्तृत उदाहरण#
कुछ रोज़मर्रा के लुकअप, सभी खोज से पाए:
- कैपिटल A —
A, या65, या0x41खोजें। पंक्ति पढ़ती है: दशमलव 65, हेक्स 41, वर्णA, नामA, एस्केप (रिक्त, क्योंकि मुद्रण योग्य वर्णों का कोई C एस्केप नहीं), श्रेणीprintable। - टैब —
tab, या9, या\t(मुक्त-टेक्स्ट पास एस्केप स्ट्रिंग से मेल खाता है) खोजें। दशमलव 9, हेक्स 09, वर्ण रिक्त (एक नियंत्रण, मुद्रण योग्य नहीं), नामHorizontal Tab, एस्केप\t, श्रेणीcontrol। - लाइन फ़ीड (newline) —
10याLine Feedखोजें। दशमलव 10, हेक्स 0A, एस्केप\n। इसका पड़ोसी 13 परCarriage Return(\r) है; साथ में ये\r\nबनाम\nलाइन-समाप्ति प्रश्न समझाते हैं (FAQ देखें)। - Escape कुंजी —
Escapeया27खोजें। दशमलव 27, हेक्स 1B, एस्केप\e।
परास पर एक नोट: मुद्रण योग्य वर्ण 32 (स्पेस) से 126 (टिल्ड ~) तक चलते हैं। स्पेस के नीचे के 32 कोड (0–31) और कोड 127 (Delete) नियंत्रण वर्ण हैं — वे ग्लिफ़ प्रिंट नहीं करते; वे टर्मिनल या टेक्स्ट स्ट्रीम को कुछ संकेत करते हैं। वह सीमा जानना सबसे उपयोगी ASCII तथ्य है: 32 से 126 तक का कोई भी बाइट एक दृश्य (या स्पेस) वर्ण है, 32 से नीचे या 127 पर कुछ भी एक नियंत्रण है।
अक्सर पूछे जाने वाले प्रश्न#
केवल 128 वर्ण क्यों?#
ASCII को एक 7-बिट कोड के रूप में डिज़ाइन किया गया था, और 2 की घात 7 में 128 है — यह पूर्ण परास है, 0 से 127। इस समूह के बाहर के वर्ण (उच्चारण वाले अक्षर, सिरिलिक, CJK, इमोजी) ASCII नहीं हैं; वे Latin-1 जैसे विस्तारित समूहों में या, आधुनिक वेब पर, UTF-8 के रूप में कूटबद्ध Unicode में आते हैं। सुविधाजनक रूप से, UTF-8 पहले 128 कोडपॉइंट को ASCII के समान ही कूटबद्ध करता है, इसलिए शुद्ध-ASCII टेक्स्ट मुफ़्त में वैध UTF-8 है।
\r\n या \n — कौन-सा newline?#
दोनों मौजूद हैं, और वे भिन्न कोडपॉइंट हैं। \n लाइन फ़ीड है (दशमलव 10); \r कैरिज रिटर्न है (दशमलव 13)। Windows पुरानी टेलिटाइप परंपरा का पालन करता है और दोनों को एक साथ (\r\n) लाइन समाप्त करने हेतु उपयोग करता है; Unix और आधुनिक Mac केवल \n उपयोग करते हैं। इसीलिए किसी सख्त Unix एडिटर में खोली गई Windows टेक्स्ट फ़ाइल लाइन अंत में ^M कलाकृतियाँ दिखा सकती है, और इसीलिए Git में core.autocrlf सेटिंग्स हैं ही।
0x41 और 41h में क्या अंतर है?#
कुछ नहीं — वे उसी hex संख्या के दो सामान्य अंकन हैं। 0x41 C/Java/JavaScript उपसर्ग शैली है; 41h असेंबली-भाषा प्रत्यय शैली है। यह संदर्भ दोनों स्वीकार करता है, आगे के अक्षरों सहित या बिना, इसलिए आप जो भी रूप आपका स्रोत उपयोग करता है चिपका सकते हैं।
कोडपॉइंट 0 क्या है?#
यह Null है — सभी-शून्य बाइट। C में यह स्ट्रिंग्स समाप्त करता है (“null terminator”); कई प्रोटोकॉल में यह आरक्षित या निषिद्ध है; एक वर्ण के रूप में यह कुछ प्रिंट नहीं करता और तालिका इसे एस्केप \0 के साथ control के अंतर्गत सूचीबद्ध करती है। यह अंक शून्य (दशमलव 48) और स्पेस वर्ण (दशमलव 32) से भिन्न है, जो भ्रम का सामान्य स्रोत है।