ツール
ガイド

中国語漢字 → ピンイン変換

変換

漢字を3つの声調形式(声調記号・数字・無声調)で同時にピンイン変換します。多音字の検出と姓氏モードに対応します。

100% クライアントサイド バックエンドなし
入力
出力
声調記号
声調数字
無声調
多音字の候補
変換する中国語漢字を入力してください。
このページの内容

ピンインとは?#

ピンインは、北京語の発音をラテンアルファベットで書き表す公式な体系です。各漢字は 1 音節に対応し、その音節は頭子音(子音)、韻母(母音群)、そして声調 — 意味を変える 4 つのピッチ輪郭(プラス軽声)のいずれか — で綴られます。mā(母)、má(麻)、mǎ(馬)、mà(叱る)は、声調が違うだけのまったく別の 4 語です。

漢字 → ピンイン変換器は、中国語テキストを取り、その音声転写を生成します。難しいのは綴りではなく、曖昧性解消です。多くの漢字は多音字(多音字)であり、同じ漢字が属する語によって異なる読み方を持ちます。重は 重要(重要)では zhòng ですが、重庆(重慶、「重なる喜び」)では chóng です。素朴な辞書引きはこれを間違えます。本ツールは各漢字をコンテキスト認識エンジンに通し、加えて見つけた多音字をすべてフラグするため、候補の読みを一目で確認できます。

本ページは 3 つの声調表記を一度に出力します。声調記号(nǐ hǎo)、声調数字(ni3 hao3)、無声調(ni hao)。下流のシステムがフラッシュカード、字幕、検索インデックス、ローマ字ファイル名のいずれを期待していても、二度変換せずに直接コピーできます。

使い方#

  1. 左側の入力欄に中国語テキストを貼り付けます。簡体・繁体を問わず任意の漢字が変換され、ラテン文字、数字、句読点、空白はそのまま通過するため、Hello 你好 123 のような混在も自由に扱えます。
  2. 右ペインに 3 つの行が埋まります。声調記号(母音の上に声調記号)、声調数字(末尾に 1〜4 の数字)、無声調(声調なし)。各行の隣にあるコピーボタンを使います。
  3. 先頭の文字が姓氏のときは姓氏モードにチェックを入れます。一部の姓は非デフォルトの読みを持つため、これが重要です。単は通常 dān ですが姓としては Shàn、区は通常 qū ですが姓としては Ōu です。
  4. 多音字の候補テーブルは、入力内で複数の読み方を持ち得る各漢字を、すべての候補を声調記号形式で表示して一覧にします。曖昧な文字を抜き出して確認するのに使います。
  5. すべてコピーで 3 つの声調モードを一度に取得します。サンプルでデモを読み込み、クリアで入力を空にします。

主な機能#

  • 1 パスで 3 つの声調モード。 声調記号/声調数字/無声調は同じエンジン呼び出しから一緒に計算されるため、3 つの行は常に整合します。声調数字が声調記号と合わないリスクはありません。
  • 多音字(多音字)の検出。 各漢字についてすべての読み方を再照会し、複数の読みを持つ文字はすべての候補とともにリストされます。エンジンがコンテキストに合ったものを選んだか確認できます。
  • 姓氏モード。 先頭文字についてエンジンの姓認識パスを切り替え、単(Shàn)、区(Ōu)、解(Xiè)、朴(Piáo)のような、汎用引きでは間違える姓を修正します。
  • サロゲートセーフなカウント。 文字カウンタは UTF-16 コード単位ではなく Unicode コードポイントで文字列を歩くため、稀な拡張 B 面の漢字(4 バイト)も正しく数えられます。
  • 辞書をローカルに同梱。 CJK 辞書はページバンドル内に収まり、ネットワーク呼び出しも API キーもなく、ブラウザから外に出るものはありません。

実例#

你好世界(「こんにちは世界」)と入力します。

Symbol: nǐ hǎo shì jiè
Num:    ni3 hao3 shi4 jie4
None:   ni hao shi jie
Polyphones: 好 → hǎo / hào

多音字テーブルは早くも 好 をフラグします。これは 2 つの読み(hǎo「良い」と hào「好む」)を持ちます。ここではエンジンがコンテキストから正しく hǎo を選びました。テーブルは、コンテキストが特殊な場合に代替を見て上書きできるようにあります。

次に 重庆(都市の重慶)を試します。ここではエンジンは 重 を、より一般的な zhòng ではなく chóng と読みます。

Symbol: chóng qìng
Num:    chong2 qing4
None:   chong qing
Polyphones: 重 → chóng / zhòng

姓氏モードの実例を見るには 单先生(「単さん」)と入力します。チェックを外した状態ではエンジンは 単 をデフォルトの dān と読みます。姓氏モードにチェックを入れると、姓としての読み shàn に切り替わります。

Surname off:  dān xiān shēng
Surname on:   shàn xiān shēng

よくある質問#

なぜ同じ漢字が時々 2 つの読み方を持ちますか?#

それが多音字(多音字)だからです。1 つの書形に対し複数の発音形があり、現れる語によって選ばれます。的 は 4 通りに読まれます。de(所有の 的)、dí(的确「確かに」)、dì(目的「目的」)、dī(的士「タクシー」)。エンジンは周囲のコンテキストから最も可能性の高い読みを選び、多音字テーブルが代替を提示するため、コンテキストが特殊な場合に上書きできます。

どの声調形式を使うべきですか?#

テキストの行き先によります。声調記号は人間向けの表示と、学習者が読むあらゆるものに適しています。声調数字は古い検索システム、一部のフラッシュカード取り込み形式、ピンインソートコードが期待するものです。無声調は声調が関係ない場合 — ローマ字ファイル名、URL スラッグ、大まかな音声インデックス — に合います。本ページは 3 つすべてを与えるため、二度変換する必要はありません。

広東語や他の方言に対応していますか?#

いいえ。本ツールは普通話(プートンホア)のピンインのみを転写します。広東語の jyutping、台湾の bopomofo(注音)、その他のローマ字化は、独自の辞書を持つ別体系です。音を出すのではなく、簡体と繁体の文字を切り替えたい場合は、簡繁変換器を使ってください。

文字カウンタは実際に何を数えますか?#

バイトや UTF-16 単位ではなく、漢字のコードポイント — 中国語の表語文字 — を数え、4 バイトの補助面文字も正しく扱います。你好 は 2 と数えられ、JavaScript の string.length が 4 と報告するような拡張 B 面の漢字 2 文字の組も同様に 2 になります。入力内の句読点とラテン文字はカウンタによって無視されます。