Ferramentas
Guias

Conversor de chinês para pinyin

Conversão

Converte caracteres chineses (Hanzi) para pinyin em três formas tonais de uma vez — marcas de tom, números de tom e sem tons. Detecta polifones e suporta o modo sobrenome.

100% no cliente Sem backend
Entrada
Saída
Marcas de tom
Números de tom
Sem tons
Candidatos polifones
Insira caracteres chineses para converter.
Nesta página

O que é pinyin?#

Pinyin é o sistema oficial para escrever os sons do mandarim no alfabeto latino. Cada caráter chinês (Hanzi) corresponde a uma sílaba, e essa sílaba escreve-se com uma inicial (uma consoante), uma final (um grupo vocálico) e um tom — um de quatro contornos de altura (mais o tom neutro) que mudam o significado. mā (mãe), má (cânhamo), mǎ (cavalo) e mà (repreender) são quatro palavras completamente diferentes que diferem apenas no tom.

Um conversor de Hanzi para Pinyin recebe texto chinês e produz a sua transcrição fonética. O difícil não é a ortografia — é a desambiguação. Muitos carateres são polifones (多音字): o mesmo caráter tem leituras diferentes consoante a palavra de que faz parte. 重 é zhòng em 重要 (importante) mas chóng em 重庆 (Chongqing, “celebração dupla”). Uma procura ingénua num dicionário erra estas; esta ferramenta passa cada caráter por um motor sensível ao contexto e sinaliza adicionalmente cada polifone que encontra, para que se vejam todas as leituras candidatas num relance.

Esta página renderiza três notações de tom de uma só vez — marcas de tom (nǐ hǎo), números de tom (ni3 hao3) e sem tons (ni hao) — pelo que qualquer que seja o formato que o sistema a jusante espera (flashcards, legendas, índices de pesquisa, nomes de arquivo romanizados), pode copiá-lo diretamente sem converter duas vezes.

Como usar#

  1. Cole o texto chinês no campo Entrada à esquerda. Qualquer Hanzi (simplificado ou tradicional) é convertido; letras latinas, dígitos, pontuação e espaços passam intactos, pelo que pode misturar Hello 你好 123 livremente.
  2. O painel direito preenche-se com três linhas: Marcas de tom (acentos sobre as vogais), Números de tom (1–4 no fim) e Sem tons. Use o botão Copiar ao lado de cada linha.
  3. Assinale Modo sobrenome quando os primeiros carateres são um nome de família. Isto importa porque alguns apelidos têm uma leitura não-padrão: 单 é normalmente dān mas Shàn como apelido; 区 é qū normalmente mas Ōu como apelido.
  4. A tabela de Candidatos polifones lista todos os carateres da sua entrada com mais do que uma leitura possível, com todos os candidatos em forma de marca de tom. Use-a para verificar carateres ambíguos.
  5. Copiar tudo recolhe os três modos de tom de uma vez; Exemplo carrega uma demonstração; Limpar esvazia a entrada.

Principais recursos#

  • Três modos de tom numa passagem. Marcas / números / sem são calculados em conjunto pela mesma chamada do motor, pelo que as três linhas estão sempre consistentes — sem risco de um número que não corresponda à sua marca.
  • Deteção de polifones (多音字). Cada Hanzi é consultado de novo para todas as suas leituras; qualquer caráter com mais do que uma é listado com todos os candidatos, para que se confirme que o motor escolheu a certa para o seu contexto.
  • Modo sobrenome. Alterna o caminho sensível a apelidos do motor para os primeiros carateres, corrigindo nomes como 单 (Shàn), 区 (Ōu), 解 (Xiè), 朴 (Piáo) que uma procura genérica erra.
  • Contagem segura por surrogate. O contador de carateres percorre a string por ponto de código Unicode, não por unidade de código UTF-16, pelo que ideogramas raros da Extensão-B (4 bytes) contam corretamente.
  • Dicionário embutido localmente. O dicionário CJK vem dentro do bundle da página — sem chamada de rede, sem chave de API, nada sai do seu navegador.

Exemplo detalhado#

Escreva 你好世界 (“olá mundo”):

Symbol: nǐ hǎo shì jiè
Num:    ni3 hao3 shi4 jie4
None:   ni hao shi jie
Polyphones: 好 → hǎo / hào

A tabela de polifones já sinaliza 好, que tem duas leituras (hǎo “bom” e hào “gostar de”). Aqui o motor escolheu corretamente hǎo pelo contexto — a tabela está lá para que se vejam as alternativas e se sobreponha quando o contexto é invulgar.

Agora experimente 重庆 (a cidade de Chongqing). Aqui o motor lê 重 como chóng, não o seu mais comum zhòng:

Symbol: chóng qìng
Num:    chong2 qing4
None:   chong qing
Polyphones: 重 → chóng / zhòng

Para ver o modo sobrenome em ação, escreva 单先生 (“Sr. Shan”). Com a caixa desmarcada o motor lê 单 com o seu dān padrão; assinale Modo sobrenome e ele muda para a leitura de apelido shàn:

Surname off:  dān xiān shēng
Surname on:   shàn xiān shēng

Perguntas frequentes#

Porque é que o mesmo caráter às vezes tem duas leituras?#

Porque é um polifone (多音字) — uma forma escrita, várias formas faladas, escolhidas pela palavra em que aparece. 的 lê-se de 4 formas: de (possessivo 的), dí (的确 “efetivamente”), dì (目的 “propósito”), dī (的士 “táxi”). O motor escolhe a leitura mais provável a partir do contexto envolvente, e a tabela de polifones mostra as alternativas para que se sobreponha quando o contexto é invulgar.

Que formato de tom devo usar?#

Depende de para onde o texto vai. Marcas de tom são as certas para exposição virada para humanos e para tudo o que os aprendizes vão ler. Números de tom são o que sistemas de pesquisa antigos, alguns formatos de importação de flashcards e código de ordenação por pinyin esperam. Sem tons serve os casos em que o tom é irrelevante — nomes de arquivo romanizados, slugs de URL, um índice fonético aproximado. Esta página dá-lhe os três para não ter de converter duas vezes.

Suporta cantonês ou outros dialetos?#

Não — esta ferramenta transcreve apenas pinyin de mandarim (Putonghua). Jyutping de cantonês, bopomofo de Taiwan (zhuyin) e outras romanizações são sistemas separados com os seus próprios dicionários. Se precisa de alternar um texto entre carateres simplificados e tradicionais em vez de o soletrar, use o conversor simplificado-tradicional em /en/convert/simplified-traditional/.

O que conta efetivamente o contador de carateres?#

Conta pontos de código Hanzi — ideogramas chineses — não bytes nem unidades UTF-16, e trata carateres de 4 bytes do plano suplementar corretamente. 你好 conta como 2, e o mesmo faz um par de carateres raros da Extensão-B que o string.length do JavaScript reportaria como 4. A pontuação e o texto latino na sua entrada são ignorados pelo contador.