চীনা অক্ষর থেকে পিনয়িন রূপান্তরক
রূপান্তরচীনা অক্ষর (হানজি) একসাথে তিনটি স্বররূপে পিনয়িনে রূপান্তর করুন — স্বরচিহ্ন, স্বর সংখ্যা এবং স্বরহীন। বহুধ্বনিক অক্ষর শনাক্ত করে এবং পদবি মোড সমর্থন করে।
- স্বরচিহ্ন
- স্বর সংখ্যা
- স্বরহীন
এই পৃষ্ঠায়
পিনয়িন কী?#
পিনয়িন হলো ম্যান্ডারিন চাইনিজের শব্দগুলোকে লাতিন বর্ণমালায় লেখার অফিসিয়াল ব্যবস্থা। প্রতিটি চাইনিজ অক্ষর (Hanzi) একটি সিলেবলে ম্যাপ করে, এবং সেই সিলেবলটি একটি প্রাথমিক (একটি ব্যঞ্জনবর্ণ), একটি চূড়ান্ত (একটি স্বরধ্বনি গ্রুপ), এবং একটি স্বর দিয়ে বানানো — চারটি পিচ কনট্যুরের একটি (প্লাস নিরপেক্ষ স্বর) যা অর্থ পরিবর্তন করে। mā (মা), má (শণ), mǎ (ঘোড়া) এবং mà (তিরস্কার) চারটি সম্পূর্ণ আলাদা শব্দ যা কেবল স্বরে আলাদা।
একটি Hanzi-থেকে-পিনয়িন রূপান্তরক চাইনিজ টেক্সট নেয় এবং তার ফোনেটিক ট্রান্সক্রিপশন তৈরি করে। কঠিন অংশ বানান নয় — এটি অসংখ্যতা দূর করা। অনেক অক্ষর বহুধ্বনিক (多音字): একই অক্ষরের ভিন্ন পাঠ আছে এটি যে শব্দের অংশ তার উপর নির্ভর করে। 重 হলো zhòng 重要 (গুরুত্বপূর্ণ)-এ কিন্তু chóng 重庆 (চংকিং, “দ্বিগুণ উদ্যাপন”)-এ। একটি সরল অভিধান লুকআপ এগুলো ভুল করে; এই টুল প্রতিটি অক্ষরকে একটি প্রসঙ্গ-সচেতন ইঞ্জিনের মাধ্যমে চালায় এবং অতিরিক্তভাবে এটি যা খুঁজে পায় প্রতিটি বহুধ্বনিক চিহ্নিত করে, যাতে আপনি সমস্ত প্রার্থী পাঠ একনজরে দেখতে পারেন।
এই পৃষ্ঠাটি একসাথে তিনটি স্বর সংকেত রেন্ডার করে — স্বরচিহ্ন (nǐ hǎo), স্বর সংখ্যা (ni3 hao3), এবং স্বরহীন (ni hao) — যাতে আপনার ডাউনস্ট্রিম সিস্টেম যে ফরম্যাটই আশা করুক (ফ্ল্যাশকার্ড, সাবটাইটেল, অনুসন্ধান সূচক, রোমানাইজড ফাইলের নাম), আপনি দুবার রূপান্তর না করেই সরাসরি কপি করতে পারেন।
কীভাবে ব্যবহার করবেন#
- বাম দিকের ইনপুট বক্সে চাইনিজ টেক্সট পেস্ট করুন। যেকোনো Hanzi (সরলীকৃত বা ঐতিহ্যবাহী) রূপান্তরিত হয়; লাতিন অক্ষর, সংখ্যা, যতিচিহ্ন এবং সাদাসিধে অপরিবর্তিত পাস হয়, তাই আপনি
Hello 你好 123অবাধে মিক্স করতে পারেন। - ডান পেন তিনটি সারিতে পূরণ হয়: স্বরচিহ্ন (স্বরধ্বনির উপর স্বর চিহ্ন), স্বর সংখ্যা (শেষে ১–৪ সংখ্যা), এবং স্বরহীন (কোনো স্বর ছাড়া)। প্রতিটি সারির পাশের কপি বোতাম ব্যবহার করুন।
- শীর্ষের অক্ষরগুলো যখন একটি পদবি হয় তখন পদবি মোড টিক চিহ্ন দিন। এটি গুরুত্বপূর্ণ কারণ কিছু পদবির একটি অ-ডিফল্ট পাঠ আছে: 单 সাধারণত
dānকিন্তু পদবি হিসেবেShàn; 区 সাধারণতqūকিন্তু পদবি হিসেবেŌu। - বহুধ্বনিক টেবিল আপনার ইনপুটের প্রতিটি অক্ষরকে তালিকাভুক্ত করে যার একাধিক সম্ভাব্য পাঠ আছে, তার সমস্ত প্রার্থী স্বরচিহ্ন রূপে দেখানো হয়। অসংখ্যতাপূর্ণ অক্ষরগুলো স্পট-চেক করতে এটি ব্যবহার করুন।
- সব কপি করুন একসাথে তিনটি স্বর মোড ধরে; নমুনা একটি ডেমো লোড করে; মুছুন ইনপুট খালি করে।
প্রধান বৈশিষ্ট্য#
- এক পাস থেকে তিনটি স্বর মোড। স্বরচিহ্ন / স্বর সংখ্যা / স্বরহীন একই ইঞ্জিন কল থেকে একসাথে গণনা করা হয়, তাই তিনটি সারি সর্বদা একমত — এমন একটি স্বর সংখ্যার ঝুঁকি নেই যা তার স্বরচিহ্নের সাথে মেলে না।
- বহুধ্বনিক (多音字) শনাক্তকরণ। প্রতিটি Hanzi-কে তার সমস্ত পাঠের জন্য পুনরায় ক্যোয়ারী করা হয়; একাধিক পাঠ আছে এমন যেকোনো অক্ষর প্রতিটি প্রার্থীসহ তালিকাভুক্ত করা হয়, যাতে আপনি নিশ্চিত করতে পারেন ইঞ্জিন আপনার প্রসঙ্গের জন্য সঠিকটি বেছেছে।
- পদবি মোড। শীর্ষের অক্ষরগুলোর জন্য ইঞ্জিনের পদবি-সচেতন পাথ টগল করে, 单 (Shàn), 区 (Ōu), 解 (Xiè), 朴 (Piáo)-এর মতো নাম ঠিক করে যা একটি সাধারণ লুকআপ ভুল করে।
- সারোগেট-নিরাপদ গণনা। অক্ষর গণনকারী স্ট্রিংটিকে UTF-16 কোড ইউনিট নয়, Unicode কোড পয়েন্ট অনুযায়ী চলে, তাই বিরল Extension-B আইডিওগ্রাফ (৪-বাইট) সঠিকভাবে গণনা হয়।
- অভিধান স্থানীয়ভাবে বান্ডল করা। CJK অভিধান পৃষ্ঠা বান্ডলের ভেতরে আসে — কোনো নেটওয়ার্ক কল নেই, কোনো API কী নেই, কিছুই আপনার ব্রাউজার ছাড়ে না।
ব্যবহারের উদাহরণ#
你好世界 (“hello world”) টাইপ করুন:
Symbol: nǐ hǎo shì jiè
Num: ni3 hao3 shi4 jie4
None: ni hao shi jie
Polyphones: 好 → hǎo / hào
বহুধ্বনিক টেবিল ইতিমধ্যেই 好-কে চিহ্নিত করে, যার দুটি পাঠ আছে (hǎo “ভালো” এবং hào “পছন্দ করা”)। এখানে ইঞ্জিন প্রসঙ্গ থেকে সঠিকভাবে hǎo বেছেছে — টেবিলটি এমন জন্য আছে যাতে আপনি বিকল্পগুলো দেখতে পান এবং প্রসঙ্গ অস্বাভাবিক হলে ওভাররাইড করতে পারেন।
এখন 重庆 (শহর চংকিং) চেষ্টা করুন। এখানে ইঞ্জিন 重-কে chóng হিসেবে পড়ে, তার আরও সাধারণ zhòng নয়:
Symbol: chóng qìng
Num: chong2 qing4
None: chong qing
Polyphones: 重 → chóng / zhòng
পদবি মোড ক্রিয়ায় দেখতে, 单先生 (“মিঃ শান”) লিখুন। বাক্সটি অচিহ্নিত থাকলে ইঞ্জিন 单-কে তার ডিফল্ট dān দিয়ে পড়ে; পদবি মোড টিক দিন এবং এটি পদবি পাঠ shàn-এ পরিবর্তিত হয়:
Surname off: dān xiān shēng
Surname on: shàn xiān shēng
প্রশ্নোত্তর#
একই অক্ষরের কখনো দুটি পাঠ কেন থাকে?#
কারণ এটি একটি বহুধ্বনিক (多音字) — একটি লিখিত রূপ, একাধিক কথ্য রূপ, যে শব্দে এটি দেখা যায় তার দ্বারা নির্বাচিত। 的-কে ৪ভাবে পড়া হয়: de (মালিকানাসূচক 的), dí (的确 “প্রকৃতপক্ষে”), dì (目的 “উদ্দেশ্য”), dī (的士 “ট্যাক্সি”)। ইঞ্জিন চারপাশের প্রসঙ্গ থেকে সবচেয়ে সম্ভাব্য পাঠ বেছে নেয়, এবং বহুধ্বনিক টেবিল বিকল্পগুলো প্রকাশ করে যাতে আপনি প্রসঙ্গ অস্বাভাবিক হলে তা ওভাররাইড করতে পারেন।
আমার কোন স্বর ফরম্যাট ব্যবহার করা উচিত?#
এটি নির্ভর করে টেক্সট কোথায় যাচ্ছে তার উপর। স্বরচিহ্ন মানুষের-মুখী প্রদর্শন এবং শিক্ষার্থীরা যা পড়বে তার জন্য সঠিক। স্বর সংখ্যা হলো পুরোনো অনুসন্ধান সিস্টেম, কিছু ফ্ল্যাশকার্ড ইমপোর্ট ফরম্যাট, এবং পিনয়িন-বাছাই কোড যা আশা করে। স্বরহীন সেই ক্ষেত্রে উপযুক্ত যেখানে স্বর অপ্রাসঙ্গিক — রোমানাইজড ফাইলের নাম, URL slug, একটি আসন্ন ফোনেটিক সূচক। এই পৃষ্ঠাটি আপনাকে তিনটিই দেয় যাতে আপনাকে দুবার রূপান্তর করতে না হয়।
এটি কি ক্যান্টনিজ বা অন্যান্য উপভাষা সমর্থন করে?#
না — এই টুল কেবল ম্যান্ডারিন (Putonghua) পিনয়িন ট্রান্সক্রাইব করে। ক্যান্টনিজ jyutping, তাইওয়ানিজ bopomofo (zhuyin), এবং অন্যান্য রোমানাইজেশন আলাদা ব্যবস্থা তাদের নিজস্ব অভিধান সহ। আপনার যদি একটি টেক্সটকে সরলীকৃত এবং ঐতিহ্যবাহী অক্ষরের মধ্যে শব্দাংকনের বদলে স্থানান্তর করতে হয়, simplified-traditional converter ব্যবহার করুন।
অক্ষর গণনকারী সত্যিই কী গণনা করে?#
এটি Hanzi কোড পয়েন্ট গণনা করে — চাইনিজ আইডিওগ্রাফ — বাইট বা UTF-16 ইউনিট নয়, এবং এটি ৪-বাইট সাপ্লিমেন্টারি-প্লেন অক্ষর সঠিকভাবে পরিচালনা করে। 你好 ২ হিসেবে গণনা হয়, এবং একইভাবে Extension-B-এর দুটি বিরল অক্ষরের জোড়াও যা JavaScript-এর string.length ৪ হিসেবে রিপোর্ট করত। আপনার ইনপুটের যতিচিহ্ন এবং লাতিন টেক্সট গণনাকারী দ্বারা উপেক্ষিত।