টুল
গাইড

ASCII অক্ষর সারণী

রেফারেন্স

১২৮টি মানক ASCII (০–১২৭) কোড পয়েন্টের তথ্যসূত্র: দশমিক, হেক্স, গ্লিফ, নাম ও C-স্টাইল এস্কেপ, অনুসন্ধান সহ।

100% ক্লায়েন্ট-সাইড কোনো ব্যাকএন্ড নেই
দশমিক হেক্স অক্ষর নাম এস্কেপ বিভাগ
এই পৃষ্ঠায়

ASCII অক্ষর রেফারেন্স কী?#

ASCII হলো সেই ৭-বিট ক্যারেক্টার সেট যা ওয়েবে প্রায় প্রতিটি টেক্সট ফরম্যাটের ভিত্তি। এটি হুবহু ১২৮টি কোড পয়েন্ট সংজ্ঞায়িত করে — ০ থেকে ১২৭ পর্যন্ত সংখ্যা — এবং প্রতিটিকে একটি অর্থ বরাদ্দ করে: একটি মুদ্রণযোগ্য গ্লিফ (অক্ষর, সংখ্যা, যতিচিহ্ন), একটি নিয়ন্ত্রণ সংকেত (ট্যাব, লাইন ফিড, এস্কেপ, সেই ঘণ্টা যা একসময় একটি টেলিটাইপে একটি বাস্তব ঘণ্টা বাজাত), বা মাঝখানের স্থান অক্ষর। যেকোনো বাইট যার মান ১২৮-এর নিচে তা একটি ASCII অক্ষর, এবং যেহেতু UTF-8 ইচ্ছাকৃতভাবে প্রথম ১২৮টি কোড পয়েন্টের জন্য ASCII-এর সাথে ওভারল্যাপ করতে ডিজাইন করা হয়েছে, একটি শুধু-ASCII নথি স্বয়ংক্রিয়ভাবে একটি বৈধ UTF-8 নথি। তাই এই পৃষ্ঠার অক্ষরগুলো, আপনার কীবোর্ডের কীগুলো, এবং একটি JSON ফাইলের বাইটগুলো সবই, মূলে, ASCII।

ছোট হওয়া সত্ত্বেও, ASCII বিবরণে পূর্ণ যা ডেভেলপারদের প্রায়ই প্রয়োজন হয়: একটি স্পেসের দশমিক কোড কত (৩২), এস্কেপ কী-এর হেক্স কত (1B), কোন C এস্কেপ একটি ট্যাব লেখে (\t), মুদ্রণযোগ্য পরিসর কোথায় শুরু ও শেষ হয়। এই পৃষ্ঠাটি সমস্ত ১২৮টি কোড পয়েন্টের একটি অনুসন্ধানযোগ্য টেবিল যাতে তাদের দশমিক মান, হেক্স মান, গ্লিফ, নাম, C-স্টাইল এস্কেপ এবং বিভাগ রয়েছে।

যেভাবে ব্যবহার করবেন#

  1. আপনি যেভাবে মনে রাখেন সেভাবে অনুসন্ধান করুন। অনুসন্ধান বাক্সটি বেশ কয়েকটি রূপ গ্রহণ করে, সবচেয়ে-নির্দিষ্ট আগে চেষ্টা করা হয়:
    • একটি উপসর্গ বা প্রত্যয় সহ হেক্স — 0x41 বা 41h হেক্স কোড পয়েন্ট দ্বারা মেলে (প্রিফিক্স ম্যাচ অনুমোদিত, তাই 0x4 ৪ দিয়ে শুরু হওয়া প্রতিটি কোড পয়েন্ট তালিকাভুক্ত করে)।
    • সরল দশমিক — 65 সেই নির্দিষ্ট কোড পয়েন্টে ঝাঁপ দেয়।
    • একটি একক অক্ষর — A টাইপ করুন এবং আপনি কোড পয়েন্ট ৬৫ পান (কেস-সংবেদনশীল, তাই A এবং a ভিন্ন সারি)।
    • একটি শব্দ — tab, escape, null নাম, গ্লিফ বা এস্কেপ স্ট্রিংয়ের বিপরীতে মেলে।
  2. সারিটি পড়ুন। কলামগুলো হলো দশমিক (দশমিক কোড পয়েন্ট), হেক্স (দুই-অঙ্কের হেক্স), অক্ষর (আক্ষরিক গ্লিফ, নন-প্রিন্টেবল কন্ট্রোলের জন্য খালি), নাম (প্রমাণ নাম যেমন “Line Feed”), এস্কেপ (C-স্টাইল ফর্ম যদি থাকে, যেমন \n), এবং বিভাগ (control, whitespace, বা printable)।

প্রধান বৈশিষ্ট্য#

  • সমস্ত ১২৮টি কোড পয়েন্ট। সম্পূর্ণ ৭-বিট পরিসর, ০ থেকে ১২৭ — কিছুই বাদ দেওয়া হয়নি, কিছুই অতিরিক্ত নয়।
  • তিনটি বিভাগ যা স্পেক কীভাবে ভাগ করে তার সাথে মেলে। ৩২টি কন্ট্রোল অক্ষর (০–৩১) সাথে DEL (১২৭), একক শূন্যস্থান অক্ষর (স্পেস, ৩২), এবং ৯৪টি মুদ্রণযোগ্য অক্ষর (৩৩–১২৬) — বিভাগ অনুযায়ী রঙ-কোডেড যাতে কাঠামোটি এক নজরে দৃশ্যমান।
  • C-স্টাইল এস্কেপ যেখানে বিদ্যমান। \0, \a, \b, \t, \n, \v, \f, \r, \e কন্ট্রোলের জন্য যেগুলোর একটি ডেডিকেটেড ফর্ম আছে; স্পেসের জন্য \s; DEL-এর জন্য \x7F। কার্যকর যখন আপনার সংখ্যা নয় এস্কেপ প্রয়োজন।
  • নমনীয় অনুসন্ধান। দশমিক, হেক্স (0x বা h সহ), একক অক্ষর, বা ফ্রি টেক্সট — যে ফর্মটি আপনার হাতে আছে।
  • ব্রাউজারে, অফলাইনে চলে। সম্পূর্ণ টেবিল পৃষ্ঠার সাথে শিপ হয়; ফিল্টারিং তাৎক্ষণিক এবং স্থানীয়।

বিস্তারিত উদাহরণ#

প্রতিদিনের কয়েকটি লুকআপ, সবই অনুসন্ধানের মাধ্যমে পাওয়া যায়:

  • বড় হাতের A — A, বা 65, বা 0x41 অনুসন্ধান করুন। সারিটি পড়ে: দশমিক ৬৫, হেক্স 41, অক্ষর A, নাম A, এস্কেপ (খালি, যেহেতু মুদ্রণযোগ্য অক্ষরের কোনো C এস্কেপ নেই), বিভাগ printable।
  • ট্যাব — tab, বা 9, বা \t অনুসন্ধান করুন (ফ্রি-টেক্সট পাস এস্কেপ স্ট্রিংয়ের সাথে মেলে)। দশমিক ৯, হেক্স 09, অক্ষর খালি (একটি কন্ট্রোল, মুদ্রণযোগ্য নয়), নাম Horizontal Tab, এস্কেপ \t, বিভাগ control।
  • লাইন ফিড (নতুন লাইন) — 10 বা Line Feed অনুসন্ধান করুন। দশমিক ১০, হেক্স 0A, এস্কেপ \n। ১৩-এ এর প্রতিবেশী হলো Carriage Return (\r); একসাথে তারা \r\n বনাম \n লাইন-সমাপ্তি প্রশ্ন ব্যাখ্যা করে (FAQ দেখুন)।
  • এস্কেপ কী — Escape বা 27 অনুসন্ধান করুন। দশমিক ২৭, হেক্স 1B, এস্কেপ \e।

পরিসর সম্পর্কে একটি নোট: মুদ্রণযোগ্য অক্ষরগুলো ৩২ (স্পেস) থেকে ১২৬ পর্যন্ত (টিল্ড ~)। স্পেসের নিচের ৩২টি কোড (০–৩১) এবং কোড ১২৭ হলো কন্ট্রোল অক্ষর — এগুলো কোনো গ্লিফ মুদ্রণ করে না; তারা টার্মিনাল বা টেক্সট স্ট্রিমে কিছু সংকেত দেয়। সেই সীমাটি জানাই সবচেয়ে কার্যকর ASCII তথ্য: ৩২ থেকে ১২৬ পর্যন্ত যেকোনো বাইট একটি দৃশ্যমান (বা স্পেস) অক্ষর, ৩২-এর নিচে বা ১২৭-এ যেকোনো কিছু একটি কন্ট্রোল।

সাধারণ জিজ্ঞাসা#

কেন শুধু ১২৮টি অক্ষর আছে?#

ASCII একটি ৭-বিট কোড হিসেবে ডিজাইন করা হয়েছিল, এবং ২-এর ঘাত ৭ হলো ১২৮ — এটিই সম্পূর্ণ পরিসর, ০ থেকে ১২৭। এই সেটের বাইরের অক্ষরগুলো (অ্যাকসেন্টযুক্ত অক্ষর, সিরিলিক, CJK, ইমোজি) ASCII নয়; এগুলো Latin-1-এর মতো বর্ধিত সেটের অন্তর্গত, বা, আধুনিক ওয়েবে, UTF-8 হিসেবে এনকোড করা Unicode-এর। সুবিধাজনকভাবে, UTF-8 প্রথম ১২৮টি কোড পয়েন্টকে ASCII-এর সাথে অভিন্থভাবে এনকোড করে, তাই বিশুদ্ধ-ASCII টেক্সট বিনামূল্যে বৈধ UTF-8।

\r\n নাকি \n — কোনটি নতুন লাইন?#

উভয়ই বিদ্যমান, এবং এগুলো ভিন্ন কোড পয়েন্ট। \n হলো লাইন ফিড (দশমিক ১০); \r হলো ক্যারেজ রিটার্ন (দশমিক ১৩)। Windows পুরোনো টেলিটাইপ রীতি অনুসরণ করে এবং একটি লাইন শেষ করতে উভয়কে একসাথে (\r\n) ব্যবহার করে; Unix এবং আধুনিক Mac শুধু \n ব্যবহার করে। এই কারণেই একটি Windows টেক্সট ফাইল একটি কঠোর Unix এডিটরে খুললে লাইন শেষে ^M আর্টিফ্যাক্ট দেখাতে পারে, এবং কারণ Git-এ core.autocrlf সেটিংস আছে।

0x41 এবং 41h-এর মধ্যে পার্থক্য কী?#

কিছুই না — এগুলো একই হেক্স সংখ্যার জন্য দুটি সাধারণ নোটেশন। 0x41 হলো C/Java/JavaScript প্রিফিক্স স্টাইল; 41h হলো অ্যাসেম্বলি-ল্যাঙ্গুয়েজ প্রত্যয় স্টাইল। এই রেফারেন্সটি উভয়ই গ্রহণ করে, আরও অক্ষর সহ বা ছাড়া, তাই আপনি আপনার সোর্স যে ফর্ম ব্যবহার করে তা পেস্ট করতে পারেন।

কোড পয়েন্ট ০ কী?#

এটি Null — সর্ব-শূন্য বাইট। C-তে এটি স্ট্রিং সমাপ্ত করে (“null terminator”); অনেক প্রোটোকলে এটি সংরক্ষিত বা নিষিদ্ধ; একটি অক্ষর হিসেবে এটি কিছুই মুদ্রণ করে না এবং টেবিলটি এটিকে control-এর অধীনে \0 এস্কেপ সহ তালিকাভুক্ত করে। এটি সংখ্যা শূন্য (দশমিক ৪৮) এবং স্পেস অক্ষরের (দশমিক ৩২) থেকে আলাদা, যা বিভ্রমের একটি সাধারণ উৎস।