Werkzeuge
Leitfäden

Chinesisch-in-Pinyin-Umwandler

Umwandlung

Wandelt chinesische Zeichen (Hanzi) in Pinyin in drei Tonformen zugleich um — Tonzeichen, Tonnummern und tonlos. Erkennt Polyphone und unterstützt den Familiennamenmodus.

100 % clientseitig Ohne Backend
Eingabe
Ausgabe
Tonzeichen
Tonnummern
Tonlos
Polyphon-Kandidaten
Geben Sie chinesische Zeichen zum Umwandeln ein.
Auf dieser Seite

Was ist Pinyin?#

Pinyin ist das offizielle System, um die Laute des Mandarin-Chinesischen im lateinischen Alphabet zu schreiben. Jedem chinesischen Zeichen (Hanzi) entspricht eine Silbe, und diese Silbe wird mit einem Anlaut (einem Konsonanten), einem Auslaut (einer Vokalgruppe) und einem Ton geschrieben — einer von vier Tonhöhenverläufen (plus dem neutralen Ton), die die Bedeutung verändern. mā (Mutter), má (Hanf), mǎ (Pferd) und mà (schelten) sind vier völlig verschiedene Wörter, die sich nur im Ton unterscheiden.

Ein Hanzi-zu-Pinyin-Umwandler nimmt chinesischen Text und erzeugt seine phonetische Transkription. Das Schwierige ist nicht die Schreibweise — es ist die Disambiguierung. Viele Zeichen sind Polyphone (多音字): dasselbe Zeichen hat unterschiedliche Lesungen, je nach Wort, in dem es steht. 重 ist zhòng in 重要 (wichtig), aber chóng in 重庆 (Chongqing, „doppelte Freude“). Ein naives Wörterbuch-Lookup macht das falsch; dieses Werkzeug führt jedes Zeichen durch eine kontextbewusste Engine und markiert zusätzlich jedes Polyphon, das es findet, sodass Sie alle Kandidatenlesungen auf einen Blick sehen.

Diese Seite rendert drei Tonnotationen zugleich — Tonzeichen (nǐ hǎo), Tonnummern (ni3 hao3) und tonlos (ni hao) — sodass, egal welches Format Ihr nachgelagertes System erwartet (Lernkarten, Untertitel, Suchindizes, romanisierte Dateinamen), Sie es direkt kopieren können, ohne zweimal umzuwandeln.

So wird es verwendet#

  1. Fügen Sie chinesischen Text in das Feld Eingabe auf der linken Seite ein. Jedes Hanzi (vereinfacht oder traditionell) wird umgewandelt; lateinische Buchstaben, Ziffern, Zeichensetzung und Whitespace passieren unverändert, Sie können also Hello 你好 123 frei mischen.
  2. Die rechte Spalte füllt sich mit drei Zeilen: Tonzeichen (Tonmarken über Vokalen), Tonnummern (nachgestellte 1–4) und Tonlos (ohne Töne). Nutzen Sie die Schaltfläche Kopieren neben jeder Zeile.
  3. Aktivieren Sie Familiennamenmodus, wenn die führenden Zeichen ein Familienname sind. Das ist wichtig, weil einige Familiennamen eine Nicht-Standard-Lesung haben: 单 ist normalerweise dān, als Familienname aber Shàn; 区 normalerweise qū, als Familienname Ōu.
  4. Die Tabelle Polyphone listet jedes Zeichen Ihres Textes, das mehr als eine mögliche Lesung hat, mit allen Kandidaten in Tonzeichen-Form. Nutzen Sie sie, um mehrdeutige Zeichen stichprobenartig zu prüfen.
  5. Alle kopieren holt alle drei Ton-Modi zugleich; Beispiel lädt eine Demo; Leeren leert die Eingabe.

Die wichtigsten Funktionen#

  • Drei Ton-Modi aus einem Durchgang. Tonzeichen / Tonnummern / tonlos werden zusammen aus demselben Engine-Aufruf berechnet, sodass die drei Zeilen immer übereinstimmen — keine Gefahr einer Tonnummer, die nicht zu ihrem Tonzeichen passt.
  • Polyphon-Erkennung (多音字). Jedes Hanzi wird nach allen seinen Lesungen abgefragt; jedes Zeichen mit mehr als einer wird mit jedem Kandidaten gelistet, sodass Sie bestätigen können, dass die Engine für Ihren Kontext die richtige gewählt hat.
  • Familiennamenmodus. Schaltet den familiennamenbewussten Pfad der Engine für die führenden Zeichen ein und korrigiert Namen wie 单 (Shàn), 区 (Ōu), 解 (Xiè), 朴 (Piáo), die ein generischer Lookup falsch macht.
  • Surrogate-sicheres Zählen. Der Zeichenzähler wandert über die Zeichenkette nach Unicode-Codepunkt, nicht nach UTF-16-Codeeinheit, sodass seltene Extension-B-Ideographen (4-Byte) korrekt zählen.
  • Wörterbuch lokal mitgeliefert. Das CJK-Wörterbuch liegt im Seiten-Bundle — kein Netzwerkaufruf, kein API-Schlüssel, nichts verlässt Ihren Browser.

Anwendungsbeispiel#

Tippen Sie 你好世界 („Hallo Welt“):

Tonzeichen: nǐ hǎo shì jiè
Tonnummern: ni3 hao3 shi4 jie4
Tonlos:    ni hao shi jie
Polyphone: 好 → hǎo / hào

Die Polyphon-Tabelle markiert bereits 好, das zwei Lesungen hat (hǎo „gut“ und hào „mögen“). Hier hat die Engine aus dem Kontext korrekt hǎo gewählt — die Tabelle existiert, damit Sie die Alternativen sehen und in ungewöhnlichem Kontext überschreiben können.

Versuchen Sie nun 重庆 (die Stadt Chongqing). Hier liest die Engine 重 als chóng, nicht als das häufigere zhòng:

Tonzeichen: chóng qìng
Tonnummern: chong2 qing4
Tonlos:    chong qing
Polyphone: 重 → chóng / zhòng

Um den Familiennamenmodus in Aktion zu sehen, geben Sie 单先生 ein („Herr Shan“). Bei nicht aktiviertem Feld liest die Engine 单 mit dem Standard dān; aktivieren Sie Familiennamenmodus, wechselt sie zur Familiennamen-Lesung shàn:

Familiennamenmodus aus: dān xiān shēng
Familiennamenmodus ein:  shàn xiān shēng

FAQ#

Warum hat dasselbe Zeichen manchmal zwei Lesungen?#

Weil es ein Polyphon (多音字) ist — eine geschriebene Form, mehrere gesprochene Formen, gewählt nach dem Wort, in dem es erscheint. 的 wird auf 4 Arten gelesen: de (possessiv 的), dí (的确 „in der Tat“), dì (目的 „Zweck“), dī (的士 „Taxi“). Die Engine wählt die wahrscheinlichste Lesung aus dem umgebenden Kontext, und die Polyphon-Tabelle zeigt die Alternativen, sodass Sie sie überschreiben können, wenn der Kontext ungewöhnlich ist.

Welches Tonformat soll ich verwenden?#

Es hängt davon ab, wohin der Text geht. Tonzeichen sind richtig für die menschenlesbare Darstellung und alles, was Lernende lesen werden. Tonnummern erwarten ältere Suchsysteme, manche Lernkarten-Importformate und Pinyin-Sortier-Code. Tonlos passt zu Fällen, in denen der Ton irrelevant ist — romanisierte Dateinamen, URL-Slugs, ein grober phonetischer Index. Diese Seite liefert alle drei, damit Sie nicht zweimal umwandeln müssen.

Unterstützt es Kantonesisch oder andere Dialekte?#

Nein — dieses Werkzeug transkribiert nur Mandarin (Putonghua)-Pinyin. Kantonesisches Jyutping, taiwanesisches Bopomofo (Zhuyin) und andere Romanisierungen sind separate Systeme mit eigenen Wörterbüchern. Wenn Sie einen Text zwischen vereinfachten und traditionellen Zeichen wechseln möchten, anstatt ihn lautlich zu ergründen, nutzen Sie den vereinfacht-traditionell-Umwandler.

Was zählt der Zeichenzähler tatsächlich?#

Er zählt Hanzi-Codepunkte — chinesische Ideographen — nicht Bytes oder UTF-16-Einheiten, und er behandelt 4-Byte-Zeichen der Supplementary-Ebene korrekt. 你好 zählt als 2, und ebenso ein Paar seltener Extension-B-Zeichen, die JavaScripts string.length als 4 melden würde. Zeichensetzung und lateinischer Text in Ihrer Eingabe werden vom Zähler ignoriert.