Convertisseur chinois simplifié ↔ traditionnel
ConversionConvertissez du chinois entre simplifié et traditionnel avec surlignage des différences caractère par caractère. Choisissez les variantes générale, taïwanaise (vocabulaire régional comme 内存→記憶體) ou hongkongaise. 100 % côté client via opencc-js.
Sur cette page
Qu’est-ce que le chinois simplifié ↔ traditionnel ?#
Le chinois s’écrit en deux jeux de caractères parallèles. Le simplifié (简体) est utilisé en Chine continentale, à Singapour et en Malaisie — le fruit d’une réforme des années 1950 qui a réduit le nombre de traits pour favoriser l’alphabétisation. Le traditionnel (繁體) est utilisé à Taïwan, à Hong Kong, à Macao et par de nombreuses communautés d’outre-mer ; c’est aussi la forme que l’on trouve dans les textes classiques, la calligraphie et la plupart des sources d’avant 1950.
Convertir entre les deux n’est pas un simple échange 1:1 de caractères, pour deux raisons :
- Caractères un-à-plusieurs. Plusieurs simplifications ont fusionné plusieurs caractères traditionnels en une seule forme simplifiée. Le 发 simplifié renvoie à 發 (fā, « envoyer / prospérer ») ou à 髮 (fà, « cheveu ») selon le sens. Le 干 simplifié renvoie à 幹, 乾 ou 干. Une table de recherche naïve en choisit un et se trompe sur les autres.
- Vocabulaire régional. Un même concept est souvent un mot différent selon les régions. « Mémoire » se dit 内存 en Chine continentale mais 記憶體 à Taïwan ; « logiciel » se dit 软件 sur le continent mais 軟體 à Taïwan ; « information » se dit 信息 plutôt que 資訊. La véritable localisation n’est pas achevée tant que ces expressions ne sont pas réécrites — le simple échange de caractères laisse le texte avec une saveur continentale.
Cette page gère les deux. Elle effectue la conversion au niveau du caractère pour le cas général, et applique une réécriture d’expressions sensible à la région pour Taïwan et Hong Kong, afin que la sortie se lise naturellement pour les lecteurs de chaque région au lieu de paraître issue d’une conversion automatique. Elle met aussi en évidence exactement les caractères qui ont changé, pour que vous puissiez relire d’un coup d’œil.
Comment l’utiliser#
- Choisissez un sens de conversion : Simplifié → Traditionnel ou Traditionnel → Simplifié.
- Choisissez une région :
- Général — conversion pure au niveau du caractère. À utiliser quand vous voulez seulement l’écriture inversée sans vous soucier du vocabulaire régional (texte classique, noms, ou vous localiserez le vocabulaire vous-même).
- Taïwan — conversion des caractères plus variantes d’expressions taïwanaises (内存→記憶體, 软件→軟體, 信息→資訊).
- Hong Kong — conversion des caractères plus variantes d’expressions hongkongaises depuis son propre dictionnaire régional.
- Collez votre texte dans le panneau Entrée à gauche. Le panneau Sortie à droite affiche le texte converti, avec chaque caractère qui diffère de l’entrée surligné.
- La barre d’état indique combien de caractères ont changé. Copier récupère la sortie ; Exemple charge une démo ; Effacer vide l’entrée.
Fonctionnalités clés#
- Réécriture d’expressions sensible à la région. Choisir Taïwan ou Hong Kong ne se contente pas d’échanger les caractères — cela réécrit le vocabulaire régional à l’aide des mêmes dictionnaires OpenCC qu’emploient les grandes chaînes de localisation, si bien que 内存 devient véritablement 記憶體 (et non le simple échange de caractères 內存) pour les lecteurs taïwanais.
- Surlignage des différences. La sortie est rendue comme une suite de spans, les tronçons modifiés étant enveloppés d’un surlignage. Le diff est calculé à la granularité du point de code Unicode (donc les caractères du plan supplémentaire sont correctement gérés) et utilise un alignement LCS pour les réécritures d’expressions quand les longueurs d’entrée et de sortie diffèrent.
- Les deux sens, toutes régions. Simplifié→Traditionnel et Traditionnel→Simplifié sont tous deux de plein droit, et chacun fonctionne en Général / Taïwan / Hong Kong.
- Dictionnaires embarqués localement. Le dictionnaire OpenCC complet est livré dans le bundle de la page — pas d’appel réseau, donc l’outil fonctionne hors ligne et votre texte ne quitte jamais le navigateur.
- Rendu sûr. La sortie est construite avec des API DOM contrôlées (jamais de
innerHTMLde texte utilisateur), si bien que même une entrée hostile ne peut pas injecter de balisage.
Exemple commenté#
Démarrez avec 中国汉字转换 et le sens Simplifié → Traditionnel, région Général :
Input: 中国汉字转换
Output: 中國漢字轉換 (4 caractères modifiés : 国→國, 汉→漢, 转→轉, 换→換)
Basculez maintenant la région sur Taïwan et essayez 内存 (« mémoire »). Le mode Général ne fait qu’échanger les caractères ; le mode Taïwan réécrit le mot lui-même :
General: 内存 → 內存 (niveau caractère : 内→內)
Taiwan: 内存 → 記憶體 (réécriture d'expression — le mot que Taïwan utilise réellement)
Le dictionnaire taïwanais réécrit plusieurs termes de la sorte — 软件 devient 軟體, 信息 devient 資訊. Notez qu’une expression littérale sans équivalent taïwanais n’est convertie qu’au niveau du caractère : 计算机 reste 計算機 dans toutes les régions, car les dictionnaires régionaux ne convertissent que les mots qui ont une forme locale distincte.
Pour voir l’autre sens, saisissez 繁體中文 avec Traditionnel → Simplifié :
Input: 繁體中文
Output: 繁体中文 (1 caractère modifié : 體→体)
Hong Kong utilise son propre dictionnaire variant par-dessus la conversion de caractères, distinct de celui de Taïwan, si bien que le même texte source peut ressortir légèrement différent sous les deux régions — la façon la plus rapide de confirmer quel dictionnaire est actif consiste à convertir un terme régional et à comparer.
FAQ#
Quelle est la différence entre Général, Taïwan et Hong Kong ?#
Général fait un échange 1:1 de caractères sans toucher au vocabulaire — convenable pour les noms, le texte classique, ou quand vous gérerez vous-même la formulation. Taïwan et Hong Kong ajoutent par-dessus des dictionnaires d’expressions spécifiques à la région, donc 内存→記憶體, 软件→軟體, 信息→資訊 sous Taïwan. Si votre public est à Taïwan ou à Hong Kong, choisissez toujours la région correspondante — sinon l’écriture sera juste, mais la formulation sentira le continent.
Choisira-t-il la bonne forme traditionnelle pour les caractères un-à-plusieurs (comme 发 → 發/髮) ?#
Pour une entrée au niveau de l’expression, généralement oui, car les dictionnaires régionaux lèvent l’ambiguïté grâce au contexte. Pour un caractère ambigu isolé sans contexte, aucun convertisseur automatique ne peut être certain — 发 seul peut réellement être l’un ou l’autre. Relisez toujours les caractères surlignés dans un texte juridique, médical ou publié.
Pourquoi certains caractères sont-ils surlignés dans la sortie ?#
Le surlignage marque chaque caractère qui a changé pendant la conversion, afin que vous puissiez concentrer votre relecture sur les endroits qui ont réellement bougé. Le diff est aligné au niveau du point de code, et pour les réécritures d’expressions (quand les longueurs d’entrée et de sortie diffèrent), il utilise un alignement par plus longue sous-séquence commune pour garder les tronçons surlignés significatifs plutôt que d’étaler le changement sur toute la ligne.
Quel sens choisir si mon texte est mixte ?#
Choisissez le sens de la majorité. Le convertisseur ne détecte pas automatiquement l’écriture — une détection automatique pleinement correcte pour du texte mixte exige plus de contexte qu’une table de caractères ne peut fournir. Si vous avez un document traditionnel avec quelques citations simplifiées collées, lancez Traditionnel → Simplifié ; les citations simplifiées traverseront simplement inchangées.