সরলীকৃত ↔ ঐতিহ্যবাহী চীনা কনভার্টার
রূপান্তরচীনা টেক্সট সরলীকৃত এবং ঐতিহ্যবাহীর মধ্যে অক্ষর-অক্ষর পার্থক্য হাইলাইট সহ রূপান্তর করুন। সাধারণ, তাইওয়ান (এলাকাভিত্তিক শব্দ যেমন 内存→記憶體 সহ), বা হংকং বৈচিত্র্য বেছে নিন। opencc-js-এর মাধ্যমে ১০০% ক্লায়েন্ট-সাইড।
এই পৃষ্ঠায়
সরলীকৃত ↔ ঐতিহ্যবাহী চাইনিজ কী?#
চাইনিজ দুটি সমান্তরাল অক্ষর সেটে লেখা হয়। সরলীকৃত (简体) ব্যবহৃত হয় মূল ভূখণ্ড চীন, সিঙ্গাপুর এবং মালয়েশিয়ায় — ১৯৫০-এর দশকের একটি সংস্কারের ফলাফল যা সাক্ষরতা বাড়াতে স্ট্রোক গণনা কমিয়েছিল। ঐতিহ্যবাহী (繁體) ব্যবহৃত হয় তাইওয়ান, হংকং, ম্যাকাও, এবং অনেক প্রবাসী সম্প্রদায়ের দ্বারা, এবং এটি এমন রূপ যা আপনি ক্লাসিক্যাল টেক্সট, ক্যালিগ্রাফি, এবং ১৯৫০-এর আগের বেশিরভাগ উৎসে দেখেন।
দুটির মধ্যে রূপান্তর একটি তুচ্ছ ১:১ অক্ষর বিনিময় নয়, দুটি কারণে:
- এক-থেকে-অনেক অক্ষর। বেশ কিছু সরলীকরণ একাধিক ঐতিহ্যবাহী অক্ষরকে একটি সরলীকৃত রূপে একত্রিত করেছে। সরলীকৃত 发 ফিরে যায় 發 (fā, “পাঠানো / উন্নতি”) বা 髮 (fà, “চুল”) অর্থের উপর নির্ভর করে। সরলীকৃত 干 যায় 幹, 乾, বা dry-এ। একটি সরল লুকআপ টেবিল একটি বেছে নেয় এবং বাকিগুলো ভুল করে।
- আঞ্চলিক শব্দভাণ্ডার। একই ধারণা প্রায়শই ভিন্ন অঞ্চলে একটি আলাদা শব্দ। “Memory” হলো মূল ভূখণ্ডে 内存 কিন্তু তাইওয়ানে 記憶體; “software” হলো মূল ভূখণ্ডে 软件 কিন্তু তাইওয়ানে 軟體; “information” হলো 信息 বনাম 資訊। প্রকৃত স্থানীয়করণ সম্পন্ন হয় না যতক্ষণ না এই বাক্যাংশগুলো পুনরায় লেখা হয় — কেবল অক্ষর বিনিময় করলে টেক্সটটি মূল-ভূখণ্ড-স্বাদযুক্ত শোনায়।
এই পৃষ্ঠাটি উভয়ই পরিচালনা করে। এটি সাধারণ ক্ষেত্রে অক্ষর-স্তরের রূপান্তর করে, এবং তাইওয়ান ও হংকংয়ের জন্য অঞ্চল-সচেতন বাক্যাংশ পুনর্লিখন প্রয়োগ করে, যাতে আউটপুট প্রতিটি অঞ্চলের পাঠকদের কাছে স্বাভাবিকভাবে পড়া যায়, মেশিন-রূপান্তরিত টেক্সটের মতো নয়। এটি আরও হাইলাইট করে ঠিক কোন অক্ষরগুলো পরিবর্তিত হয়েছে, যাতে আপনি একনজরে প্রুফরিড করতে পারেন।
কীভাবে ব্যবহার করবেন#
- একটি দিক বাছুন: সরলীকৃত → ঐতিহ্যবাহী বা ঐতিহ্যবাহী → সরলীকৃত।
- একটি অঞ্চল বাছুন:
- সাধারণ — বিশুদ্ধ অক্ষর-স্তরের রূপান্তর। এটি ব্যবহার করুন যখন আপনার কেবল স্ক্রিপ্ট বিনিময় প্রয়োজন এবং আঞ্চলিক শব্দব্যবহারে আপনার যত্ন নেই (ক্লাসিক্যাল টেক্সট, নাম, বা আপনি নিজে শব্দভাণ্ডার স্থানীয়করণ করবেন)।
- তাইওয়ান — অক্ষর রূপান্তর প্লাস তাইওয়ান বাক্যাংশ ভেরিয়েন্ট (内存→記憶體, 软件→軟體, 信息→資訊)।
- হংকং — অক্ষর রূপান্তর প্লাস হংকং বাক্যাংশ ভেরিয়েন্ট তার নিজস্ব আঞ্চলিক অভিধান থেকে।
- আপনার টেক্সট বাম দিকের ইনপুট পেনে পেস্ট করুন। ডান দিকের আউটপুট পেন রূপান্তরিত টেক্সট দেখায়, ইনপুট থেকে যে প্রতিটি অক্ষর আলাদা তা হাইলাইট করা সহ।
- স্ট্যাটাস বার রিপোর্ট করে কতগুলো অক্ষর পরিবর্তিত হয়েছে। কপি আউটপুট ধরে; নমুনা একটি ডেমো লোড করে; মুছুন ইনপুট খালি করে।
প্রধান বৈশিষ্ট্য#
- অঞ্চল-সচেতন বাক্যাংশ পুনর্লিখন। তাইওয়ান বা হংকং নির্বাচন করা কেবল অক্ষর বিনিময় করে না — এটি প্রধান স্থানীয়করণ পাইপলাইনগুলো যে একই OpenCC অভিধান ব্যবহার করে তা ব্যবহার করে আঞ্চলিক শব্দভাণ্ডার পুনরায় লেখে, যাতে তাইওয়ান পাঠকদের জন্য 内存 সত্যিই 記憶體 হয়ে যায় (কেবল অক্ষর বিনিময় 內存 নয়)।
- পার্থক্য হাইলাইটিং। আউটপুট স্প্যানগুলোর একটি অনুক্রম হিসেবে রেন্ডার করা হয়, পরিবর্তিত রানগুলো একটি হাইলাইটে মোড়ানো। পার্থক্যটি Unicode কোড-পয়েন্ট গ্রানুলারিটিতে গণনা করা হয় (যাতে সাপ্লিমেন্টারি-প্লেন অক্ষরগুলো সঠিকভাবে পরিচালিত হয়) এবং বাক্যাংশ পুনর্লিখনের জন্য একটি LCS অ্যালাইনমেন্ট ব্যবহার করে যেখানে ইনপুট এবং আউটপুট দৈর্ঘ্য আলাদা।
- উভয় দিক, সমস্ত অঞ্চল। সরলীকৃত→ঐতিহ্যবাহী এবং ঐতিহ্যবাহী→সরলীকৃত উভয়ই প্রথম-শ্রেণির, এবং প্রতিটি সাধারণ / তাইওয়ান / হংকং জুড়ে কাজ করে।
- অভিধান স্থানীয়ভাবে বান্ডল করা। সম্পূর্ণ OpenCC অভিধান পৃষ্ঠা বান্ডলে আসে — কোনো নেটওয়ার্ক কল নেই, তাই টুলটি অফলাইনে কাজ করে এবং আপনার টেক্সট কখনো ব্রাউজার ছাড়ে না।
- নিরাপদ রেন্ডারিং। আউটপুট নিয়ন্ত্রিত DOM API দিয়ে তৈরি (কখনো ব্যবহারকারী টেক্সটের
innerHTMLনয়), তাই এমনকি প্রতিকূল ইনপুটও মার্কআপ ইনজেক্ট করতে পারে না।
ব্যবহারের উদাহরণ#
中国汉字转换 দিয়ে শুরু করুন এবং দিক সরলীকৃত → ঐতিহ্যবাহী, অঞ্চল সাধারণ:
Input: 中国汉字转换
Output: 中國漢字轉換 (4 characters changed: 国→國, 汉→漢, 转→轉, 换→換)
এখন অঞ্চল তাইওয়ান-এ পরিবর্তন করুন এবং 内存 (“memory”) চেষ্টা করুন। সাধারণ মোড কেবল অক্ষর বিনিময় করে; তাইওয়ান মোড প্রকৃত শব্দটি পুনরায় লেখে:
General: 内存 → 內存 (character-level: 内→內)
Taiwan: 内存 → 記憶體 (phrase rewrite — the word Taiwan actually uses)
তাইওয়ান অভিধান বেশ কিছু এমন পদ পুনরায় লেখে — 软件 হয়ে যায় 軟體, 信息 হয়ে যায় 資訊। লক্ষ্য করুন যে কোনো তাইওয়ান সমতুল্য ছাড়া একটি আক্ষরিক পদ কেবল অক্ষর-রূপান্তরিত রাখা হয়: 计算机 প্রতিটি অঞ্চলে 計算機 থাকে, কারণ আঞ্চলিক অভিধানগুলো কেবল সেই শব্দগুলোই রূপান্তর করে যাদের একটি স্বতন্ত্র স্থানীয় রূপ আছে।
অন্য দিকটি দেখতে, 繁體中文 লিখুন ঐতিহ্যবাহী → সরলীকৃত সহ:
Input: 繁體中文
Output: 繁体中文 (1 character changed: 體→体)
হংকং অক্ষর রূপান্তরের উপরে তার নিজস্ব ভেরিয়েন্ট অভিধান ব্যবহার করে, তাইওয়ানের থেকে স্বতন্ত্র, তাই একই উৎস টেক্সট দুটি অঞ্চলের অধীনে সামান্য আলাদাভাবে বেরোতে পারে — কোন অভিধান সক্রিয় তা নিশ্চিত করার দ্রুততম উপায় হলো একটি আঞ্চলিক পদ রূপান্তর করা এবং তুলনা করা।
প্রশ্নোত্তর#
সাধারণ, তাইওয়ান, এবং হংকংয়ের মধ্যে পার্থক্য কী?#
সাধারণ কোনো শব্দভাণ্ডার পরিবর্তন ছাড়াই একটি ১:১ অক্ষর বিনিময় করে — নাম, ক্লাসিক্যাল টেক্সট, বা যখন আপনি নিজে শব্দব্যবহার পরিচালনা করবেন তখন ঠিক আছে। তাইওয়ান এবং হংকং উপরে অঞ্চল-নির্দিষ্ট বাক্যাংশ অভিধান স্তর যোগ করে, তাই তাইওয়ানের অধীনে 内存→記憶體, 软件→軟體, 信息→資訊। আপনার শ্রোতা যদি তাইওয়ান বা হংকংয়ে থাকে, সর্বদা মিলে যাওয়া অঞ্চল বাছুন — অন্যথায় স্ক্রিপ্ট সঠিক হবে কিন্তু শব্দব্যবহার মূল-ভূখণ্ড-স্বাদযুক্ত শোনাবে।
এটি কি এক-থেকে-অনেক অক্ষরের জন্য সঠিক ঐতিহ্যবাহী রূপ বেছে নেবে (যেমন 发 → 發/髮)?#
বাক্যাংশ-স্তরের ইনপুটের জন্য এটি সাধারণত করে, কারণ অঞ্চল অভিধানগুলো চারপাশের প্রসঙ্গ দিয়ে অসংখ্যতা দূর করে। কোনো প্রসঙ্গ ছাড়া একটি বিচ্ছিন্ন অস্পষ্ট অক্ষরের জন্য, কোনো স্বয়ংক্রিয় রূপান্তরকই নিশ্চিত হতে পারে না — একা সত্যিই যেকোনোটি হতে পারে। আইনি, চিকিৎসা, বা প্রকাশিত টেক্সটে সর্বদা হাইলাইট করা অক্ষরগুলো প্রুফরিড করুন।
আউটপুটে কিছু অক্ষর কেন হাইলাইট করা হয়?#
হাইলাইট রূপান্তরের সময় পরিবর্তিত প্রতিটি অক্ষরকে চিহ্নিত করে, যাতে আপনি আপনার প্রুফরিডিংকে সেই স্থানগুলোতে কেন্দ্রিত করতে পারেন যা সত্যিই সরেছে। পার্থক্যটি কোড-পয়েন্ট স্তরে সারিবদ্ধ, এবং বাক্যাংশ পুনর্লিখনের জন্য (যেখানে ইনপুট এবং আউটপুট দৈর্ঘ্য আলাদা) এটি পরিবর্তনকে পুরো লাইন জুড়ে ছড়িয়ে দেওয়ার বদলে হাইলাইট করা রানগুলোকে অর্থপূর্ণ রাখতে একটি দীর্ঘতম-সাধারণ-উপক্রম অ্যালাইনমেন্ট ব্যবহার করে।
আমার টেক্সট মিশ্র হলে আমার কোন দিক বাছার উচিত?#
সংখ্যাগরিষ্ঠের দিক বাছুন। রূপান্তরক স্ক্রিপ্ট স্বয়ংক্রিয়ভাবে শনাক্ষ করে না — মিশ্র টেক্সটের জন্য একটি সম্পূর্ণ সঠিক স্বয়ংক্রিয় শনাক্ষের জন্য একটি অক্ষর টেবিল যা সরবরাহ করতে পারে তার চেয়ে বেশি প্রসঙ্গ প্রয়োজন। আপনার যদি কিছু সরলীকৃত উদ্ধৃতি পেস্ট সহ একটি ঐতিহ্যবাহী নথি থাকে, ঐতিহ্যবাহী → সরলীকৃত চালান; সরলীকৃত উদ্ধৃতিগুলো অপরিবর্তিত পাস হবে।