टूल
गाइड

सरलीकृत ↔ पारंपरिक चीनी कन्वर्टर

रूपांतरण

चीनी पाठ को सरलीकृत और पारंपरिक के बीच अक्षर-अक्षर अंतर हाइलाइट के साथ बदलें। सामान्य, ताइवान (क्षेत्रीय शब्दावली जैसे 内存→記憶體 सहित), या हांगकांग वेरिएंट चुनें। opencc-js द्वारा 100% क्लाइंट-साइड।

100% क्लाइंट-साइड कोई बैकएंड नहीं
रूपांतरण दिशा
इनपुट
आउटपुट
रूपांतरित करने के लिए चीनी पाठ दर्ज करें।
इस पृष्ठ पर

सरलीकृत ↔ पारंपरिक चीनी क्या है?#

चीनी दो समानांतर अक्षर समूहों में लिखी जाती है। सरलीकृत (简体) मुख्यभूमि चीन, सिंगापुर और मलेशिया में उपयोग होती है — 1950 के दशक के सुधार का परिणाम जिसने साक्षरता बढ़ाने के लिए स्ट्रोक गिनती कम की। पारंपरिक (繁體) ताइवान, हांगकांग, मकाऊ में और कई विदेशी समुदायों द्वारा उपयोग होती है, और यही रूप आपको शास्त्रीय ग्रंथों, सुलेख और अधिकांश 1950-पूर्व स्रोतों में दिखता है।

दोनों के बीच रूपांतरण कोई तुच्छ 1:1 अक्षर अदला-बदली नहीं है, दो कारणों से:

  1. एक-से-कई अक्षर। कई सरलीकरणों ने कई पारंपरिक अक्षरों को एक सरलीकृत रूप में मिला दिया। सरलीकृत 发 वापस 發 (fā, “भेजना / उन्नति”) या 髮 (fà, “बाल”) में जाता है, अर्थ पर निर्भर। सरलीकृत 干, 幹, 乾, या 干 में मैप होता है। एक साधारण लुकअप तालिका एक चुनती है और बाकी गलत करती है।
  2. क्षेत्रीय शब्दावली। एक ही अवधारणा अक्सर अलग-अलग क्षेत्रों में एक अलग शब्द है। “स्मृति” मुख्यभूमि में 内存 है किंतु ताइवान में 記憶體; “सॉफ़्टवेयर” मुख्यभूमि में 软件 है किंतु ताइवान में 軟體; “सूचना” 信息 बनाम 資訊। असली स्थानीयकरण तब तक पूर्ण नहीं जब तक इन वाक्यांशों को पुनः लिखा न जाए — केवल अक्षर बदलने से पाठ मुख्यभूमि-स्वाद वाला सुनता है।

यह पेज दोनों को संभालता है। यह सामान्य मामले के लिए अक्षर-स्तरीय रूपांतरण करता है, और ताइवान और हांगकांग के लिए क्षेत्र-जागरूक वाक्यांश पुनर्लेखन लागू करता है, ताकि आउटपुट प्रत्येक क्षेत्र के पाठकों को स्वाभाविक पढ़ा जाए, न कि मशीन-रूपांतरित पाठ जैसा। यह यह भी हाइलाइट करता है कि ठीक कौन-से अक्षर बदले, ताकि आप एक नज़र में प्रूफ़रीड कर सकें।

इसका उपयोग कैसे करें#

  1. एक दिशा चुनें: सरलीकृत → पारंपरिक या पारंपरिक → सरलीकृत।
  2. एक क्षेत्र चुनें:
    • सामान्य — शुद्ध अक्षर-स्तरीय रूपांतरण। इसका उपयोग करें जब आपको केवल स्क्रिप्ट बदलनी है और क्षेत्रीय शब्दावली से कोई मतलब नहीं (शास्त्रीय पाठ, नाम, या आप स्वयं शब्दावली स्थानीयकृत करेंगे)।
    • ताइवान — अक्षर रूपांतरण सहित ताइवान वाक्यांश विविधताएँ (内存→記憶體, 软件→軟體, 信息→資訊)।
    • हांगकांग — अक्षर रूपांतरण सहित हांगकांग वाक्यांश विविधताएँ अपनी क्षेत्रीय शब्दकोश से।
  3. बाईं ओर इनपुट फलक में अपना पाठ चिपकाएँ। दाईं ओर का आउटपुट फलक रूपांतरित पाठ दिखाता है, हर अक्षर के साथ जो इनपुट से भिन्न है वह हाइलाइट होता है।
  4. स्थिति पट्टी रिपोर्ट करती है कि कितने अक्षर बदले। कॉपी आउटपुट लेता है; नमूना एक डेमो लोड करता है; साफ़ करें इनपुट खाली करता है।

मुख्य विशेषताएँ#

  • क्षेत्र-जागरूक वाक्यांश पुनर्लेखन। ताइवान या हांगकांग चुनना केवल अक्षर नहीं बदलता — यह प्रमुख स्थानीयकरण पाइपलाइनों द्वारा उपयोग किए गए समान OpenCC शब्दकोश उपयोग करके क्षेत्रीय शब्दावली पुनः लिखता है, ताकि 内存 सचमुच 記憶體 बने (केवल अक्षर अदला-बदली 內存 नहीं) ताइवान पाठकों के लिए।
  • अंतर हाइलाइटिंग। आउटपुट spans के अनुक्रम के रूप में रेंडर होता है, बदले हुए रन हाइलाइट में लिपटे हुए। अंतर Unicode कोडपॉइंट दानेदारी पर गणना होता है (ताकि सप्लीमेंट्री-प्लेन अक्षर सही संभाले जाएँ) और वाक्यांश पुनर्लेखन के लिए एक LCS संरेखण उपयोग करता है जहाँ इनपुट और आउटपुट लंबाई भिन्न हैं।
  • दोनों दिशाएँ, सभी क्षेत्र। सरलीकृत→पारंपरिक और पारंपरिक→सरलीकृत दोनों प्रथम-श्रेणी हैं, और प्रत्येक सामान्य / ताइवान / हांगकांग पर काम करता है।
  • शब्दकोश स्थानीय रूप से बंडल। पूरा OpenCC शब्दकोश पेज बंडल में आता है — कोई नेटवर्क कॉल नहीं, इसलिए टूल ऑफ़लाइन काम करता है और आपका पाठ कभी ब्राउज़र नहीं छोड़ता।
  • सुरक्षित रेंडरिंग। आउटपुट नियंत्रित DOM API के साथ बनता है (कभी उपयोगकर्ता पाठ का innerHTML नहीं), इसलिए यहाँ तक कि प्रतिकूल इनपुट भी मार्कअप इंजेक्ट नहीं कर सकता।

विस्तृत उदाहरण#

中国汉字转换 से शुरू करें और दिशा सरलीकृत → पारंपरिक, क्षेत्र सामान्य:

Input:   中国汉字转换
Output:  中國漢字轉換   (4 characters changed: 国→國, 汉→漢, 转→轉, 换→換)

अब क्षेत्र को ताइवान पर स्विच करें और 内存 (“स्मृति”) आज़माएँ। सामान्य मोड केवल अक्षर बदलता है; ताइवान मोड वास्तविक शब्द पुनः लिखता है:

General: 内存  →  內存      (character-level: 内→內)
Taiwan:  内存  →  記憶體    (phrase rewrite — the word Taiwan actually uses)

ताइवान शब्दकोश कई ऐसे शब्द पुनः लिखता है — 软件, 軟體 बनता है, 信息, 資訊 बनता है। ध्यान दें कि किसी ताइवानी समकक्ष रहित शब्द को केवल अक्षर-रूपांतरित छोड़ दिया जाता है: 计算机 हर क्षेत्र में 計算機 रहता है, क्योंकि क्षेत्रीय शब्दकोश केवल उन शब्दों को रूपांतरित करते हैं जिनका कोई विशिष्ट स्थानीय रूप है।

दूसरी दिशा देखने के लिए, 繁體中文 को पारंपरिक → सरलीकृत के साथ टाइप करें:

Input:   繁體中文
Output:  繁体中文   (1 character changed: 體→体)

हांगकांग अक्षर रूपांतरण के शीर्ष पर अपनी खुद की विविधता शब्दकोश उपयोग करता है, ताइवान से अलग, इसलिए एक ही स्रोत पाठ दोनों क्षेत्रों में थोड़ा अलग आ सकता है — यह पुष्टि करने का सबसे तेज़ तरीका कि कौन-सा शब्दकोश सक्रिय है, कोई क्षेत्रीय शब्द रूपांतरित करना और तुलना करना है।

अक्सर पूछे जाने वाले प्रश्न#

सामान्य, ताइवान और हांगकांग में क्या अंतर है?#

सामान्य कोई शब्दावली परिवर्तन नहीं के साथ 1:1 अक्षर अदला-बदली करता है — नामों, शास्त्रीय पाठ, या जब आप स्वयं शब्दावली संभालेंगे तब ठीक। ताइवान और हांगकांग शीर्ष पर क्षेत्र-विशिष्ट वाक्यांश शब्दकोश जोड़ते हैं, ताकि ताइवान के तहत 内存→記憶體, 软件→軟體, 信息→資訊। यदि आपके पाठक ताइवान या हांगकांग में हैं, तो हमेशा मिलान वाला क्षेत्र चुनें — अन्यथा स्क्रिप्ट सही होगी किंतु शब्दावली मुख्यभूमि-स्वाद वाली पढ़ी जाएगी।

क्या यह एक-से-कई अक्षरों के लिए सही पारंपरिक रूप चुनेगा (जैसे 发 → 發/髮)?#

वाक्यांश-स्तरीय इनपुट के लिए आमतौर पर हाँ, क्योंकि क्षेत्र शब्दकोश चारों ओर के संदर्भ से असंदिग्ध करते हैं। किसी पृथक अस्पष्ट अक्षर के लिए जिसमें कोई संदर्भ न हो, कोई भी स्वचालित परिवर्तक निश्चित नहीं हो सकता — अपने आप में 发 वास्तव में दोनों में से कोई भी हो सकता है। कानूनी, चिकित्सकीय, या प्रकाशित पाठ में हमेशा हाइलाइट किए अक्षरों को प्रूफ़रीड करें।

आउटपुट में कुछ अक्षर हाइलाइट क्यों होते हैं?#

हाइलाइट हर उस अक्षर को चिह्नित करती है जो रूपांतरण के दौरान बदला, ताकि आप अपनी प्रूफ़रीडिंग उन जगहों पर केंद्रित कर सकें जो वास्तव में खिसकीं। अंतर कोडपॉइंट स्तर पर संरेखित है, और वाक्यांश पुनर्लेखन के लिए (जहाँ इनपुट और आउटपुट लंबाई भिन्न होती हैं) यह हाइलाइट किए रन को सार्थक रखने के लिए एक longest-common-subsequence संरेखण उपयोग करता है, बजाय परिवर्तन को पूरी पंक्ति में फैलाने के।

यदि मेरा पाठ मिश्रित है तो मुझे कौन-सी दिशा चुननी चाहिए?#

बहुमत की दिशा चुनें। परिवर्तक स्क्रिप्ट स्वतः-पहचान नहीं करता — मिश्रित पाठ के लिए पूरी तरह सही स्वतः-पहचान को एक अक्षर तालिका दे सके, उससे अधिक संदर्भ चाहिए। यदि आपके पास एक पारंपरिक दस्तावेज़ है जिसमें कुछ सरलीकृत उद्धरण चिपकाए गए हैं, तो पारंपरिक → सरलीकृत चलाएँ; सरलीकृत उद्धरण बस अपरिवर्तित गुज़र जाएँगे।