Convertisseur chinois vers pinyin
ConversionConvertit les caractères chinois (Hanzi) en pinyin sous trois formes tonales à la fois — marques tonales, chiffres tonaux et sans tons. Détecte les polyphones et prend en charge le mode nom de famille.
- Marques tonales
- Chiffres tonaux
- Sans tons
Sur cette page
Qu’est-ce que le pinyin ?#
Le pinyin est le système officiel qui permet d’écrire les sons du mandarin avec l’alphabet latin. Chaque caractère chinois (Hanzi) correspond à une syllabe, et cette syllabe s’écrit avec une initiale (une consonne), une finale (un groupe vocalique) et un ton — l’un des quatre contours mélodiques (plus le ton neutre) qui changent le sens. mā (maman), má (chanvre), mǎ (cheval) et mà (gronder) sont quatre mots totalement différents qui ne diffèrent que par le ton.
Un convertisseur Hanzi-vers-pinyin prend du texte chinois et en produit la transcription phonétique. Le difficile n’est pas l’orthographe — c’est la levée d’ambiguïté. Beaucoup de caractères sont des polyphones (多音字) : le même caractère a des lectures différentes selon le mot dont il fait partie. 重 se lit zhòng dans 重要 (important) mais chóng dans 重庆 (Chongqing, « double célébration »). Une recherche naïve dans un dictionnaire se trompe sur ces cas ; cet outil passe chaque caractère dans un moteur sensible au contexte et signale en outre chaque polyphone qu’il trouve, afin que vous puissiez voir toutes les lectures candidates d’un coup d’œil.
Cette page produit trois notations tonales d’un coup — Marques tonales (nǐ hǎo), Chiffres tonaux (ni3 hao3) et Sans tons (ni hao) — si bien que, quel que soit le format qu’attend votre système en aval (cartes mémoire, sous-titres, index de recherche, noms de fichiers romanisés), vous pouvez le copier directement sans le convertir deux fois.
Comment l’utiliser#
- Collez du texte chinois dans le champ Entrée à gauche. Tout Hanzi (simplifié ou traditionnel) est converti ; lettres latines, chiffres, ponctuation et espaces passent tels quels, donc vous pouvez mélanger librement
Hello 你好 123. - Le panneau de droite se remplit en trois lignes : Marques tonales (signes diacritiques sur les voyelles), Chiffres tonaux (chiffres 1–4 en suffixe) et Sans tons (sans tons). Utilisez le bouton Copier à côté de chaque ligne.
- Cochez Mode nom de famille quand les premiers caractères sont un nom de famille. Cela compte, car certains patronymes ont une lecture non standard : 单 se lit normalement
dānmaisShàncomme patronyme ; 区 se litqūen général maisŌucomme patronyme. - Le tableau Candidats polyphones liste chaque caractère de votre entrée qui admet plus d’une lecture, avec tous ses candidats en forme diacritique. Sert à vérifier les caractères ambigus.
- Tout copier récupère les trois modes tonaux d’un coup ; Exemple charge une démo ; Effacer vide l’entrée.
Fonctionnalités clés#
- Trois modes tonaux en une passe. Marques / Chiffres / Sans tons sont calculés ensemble depuis le même appel au moteur, donc les trois lignes sont toujours cohérentes — pas de risque qu’un chiffre ne corresponde pas à son signe.
- Détection des polyphones (多音字). Chaque Hanzi est interrogé pour toutes ses lectures ; tout caractère qui en a plusieurs est listé avec chacun de ses candidats, afin que vous puissiez confirmer que le moteur a choisi la bonne pour votre contexte.
- Mode nom de famille. Bascule le chemin sensible aux patronymes du moteur pour les premiers caractères, corrigeant les noms comme 单 (Shàn), 区 (Ōu), 解 (Xiè), 朴 (Piáo) qu’une recherche générique rate.
- Comptage sécurisé pour les substituts. Le compteur de caractères parcourt la chaîne par point de code Unicode, et non par unité de code UTF-16, donc les idéogrammes rares de l’Extension B (4 octets) sont correctement comptés.
- Dictionnaire embarqué localement. Le dictionnaire CJK est livré dans le bundle de la page — pas d’appel réseau, pas de clé d’API, rien ne quitte votre navigateur.
Exemple commenté#
Saisissez 你好世界 (« bonjour le monde ») :
Symbol: nǐ hǎo shì jiè
Num: ni3 hao3 shi4 jie4
None: ni hao shi jie
Polyphones: 好 → hǎo / hào
Le tableau des polyphones signale déjà 好, qui a deux lectures (hǎo « bon » et hào « aimer »). Ici, le moteur a correctement choisi hǎo selon le contexte — le tableau est là pour que vous voyiez les alternatives et puissiez passer outre quand le contexte est inhabituel.
Essayez maintenant 重庆 (la ville de Chongqing). Ici le moteur lit 重 comme chóng, et non son plus courant zhòng :
Symbol: chóng qìng
Num: chong2 qing4
None: chong qing
Polyphones: 重 → chóng / zhòng
Pour voir le mode nom de famille en action, saisissez 单先生 (« M. Shan »). Case décochée, le moteur lit 单 avec son défaut dān ; cochez Mode nom de famille et il bascule sur la lecture patronymique shàn :
Surname off: dān xiān shēng
Surname on: shàn xiān shēng
FAQ#
Pourquoi le même caractère a-t-il parfois deux lectures ?#
Parce que c’est un polyphone (多音字) — une forme écrite, plusieurs formes orales, choisies selon le mot où il apparaît. 的 se lit de 4 façons : de (adnominal 的), dí (的确 « effectivement »), dì (目的 « but »), dī (的士 « taxi »). Le moteur choisit la lecture la plus probable d’après le contexte, et le tableau des polyphones expose les alternatives afin que vous puissiez passer outre quand le contexte est inhabituel.
Quel format de tons dois-je utiliser ?#
Cela dépend de la destination du texte. Les marques tonales conviennent à l’affichage pour les humains et à tout ce que des apprenants liront. Les chiffres tonaux sont ce qu’attendent les anciens systèmes de recherche, certains formats d’import de cartes mémoire et le code de tri pinyin. Le mode sans tons sied aux cas où le ton n’a pas d’importance — noms de fichiers romanisés, slugs d’URL, index phonétique grossier. Cette page vous donne les trois, pour que vous n’ayez pas à convertir deux fois.
Gère-t-il le cantonais ou d’autres dialectes ?#
Non — cet outil ne transcrit que le pinyin du mandarin (Putonghua). Le jyutping cantonais, le bopomofo taïwanais (zhuyin) et les autres romanisations sont des systèmes séparés, avec leurs propres dictionnaires. Si vous avez besoin de faire passer un texte des caractères simplifiés aux traditionnels plutôt que de le transcrire phonétiquement, utilisez le convertisseur simplifié-traditionnel.
Que compte réellement le compteur de caractères ?#
Il compte les points de code Hanzi — les idéogrammes chinois — et non les octets ni les unités UTF-16, et il gère correctement les caractères 4 octets du plan supplémentaire. 你好 compte pour 2, et il en va de même pour une paire de caractères rares de l’Extension B que le string.length de JavaScript compterait comme 4. La ponctuation et le texte latin de votre entrée sont ignorés par le compteur.