Conversor de chino a pinyin
ConversiónConvierte caracteres chinos (Hanzi) a pinyin en tres formas tonales a la vez — marcas de tono, números de tono y sin tonos. Detecta polifonos y admite el modo apellido.
- Marcas de tono
- Números de tono
- Sin tonos
En esta página
¿Qué es el pinyin?#
El pinyin es el sistema oficial para escribir los sonidos del chino mandarín en el alfabeto latino. Cada carácter chino (Hanzi) se corresponde con una sílaba, y esa sílaba se escribe con una inicial (una consonante), una final (un grupo vocálico) y un tono, uno de cuatro contornos de entonación (más el tono neutro) que cambian el significado. mā (madre), má (cáñamo), mǎ (caballo) y mà (reñir) son cuatro palabras completamente distintas que solo se diferencian por el tono.
Un conversor de Hanzi a pinyin toma texto chino y produce su transcripción fonética. Lo difícil no es la ortografía, sino la desambiguación. Muchos caracteres son polifonos (多音字): el mismo carácter tiene lecturas distintas según la palabra de la que forme parte. 重 es zhòng en 重要 (importante), pero chóng en 重庆 (Chongqing, «doble celebración»). Una simple búsqueda en diccionario falla en estos casos; esta herramienta pasa cada carácter por un motor consciente del contexto y, además, señala cada polifono que encuentra, para que veas todas las lecturas candidatas de un vistazo.
Esta página muestra a la vez tres notaciones de tono —marcas de tono (nǐ hǎo), números de tono (ni3 hao3) y sin tonos (ni hao)—, así que, sea cual sea el formato que espere tu sistema destino (tarjetas de estudio, subtítulos, índices de búsqueda, nombres de archivo romanizados), puedes copiarlo directamente sin convertir dos veces.
Cómo se usa#
- Pega texto chino en la caja de Entrada de la izquierda. Cualquier Hanzi (simplificado o tradicional) se convierte; las letras latinas, los dígitos, los signos de puntuación y los espacios en blanco pasan intactos, así que puedes mezclar
Hello 你好 123libremente. - El panel derecho rellena tres filas: Marcas de tono (marcas sobre las vocales), Números de tono (dígitos 1–4 al final) y Sin tonos (sin tonos). Usa el botón Copiar que aparece junto a cada fila.
- Marca Modo apellido cuando los caracteres iniciales sean un apellido. Esto importa porque algunos apellidos tienen una lectura distinta de la habitual: 单 normalmente es
dān, peroShàncomo apellido; 区 esqūpor lo general, peroŌucomo apellido. - La tabla de polifonos enumera cada carácter de tu entrada que tiene más de una lectura posible, con todos sus candidatos en forma de marca de tono. Úsala para revisar los caracteres ambiguos.
- Copiar todo toma a la vez los tres modos de tono; Ejemplo carga una demostración; Limpiar vacía la entrada.
Características clave#
- Tres modos de tono en una sola pasada. Marcas / números / sin tonos se calculan a la vez desde la misma llamada al motor, así que las tres filas siempre coinciden: sin riesgo de un número que no cuadre con su marca.
- Detección de polifonos (多音字). Cada Hanzi se vuelve a consultar para todas sus lecturas; cualquier carácter con más de una se enumera con cada candidato, de modo que puedes confirmar que el motor eligió la correcta para tu contexto.
- Modo apellido. Activa la ruta del motor consciente de apellidos para los caracteres iniciales y corrige nombres como 单 (Shàn), 区 (Ōu), 解 (Xiè), 朴 (Piáo), que una búsqueda genérica pifia.
- Recuento seguro con suplentes. El contador de caracteres recorre la cadena por punto de código Unicode, no por unidad de código UTF-16, así que los ideogramas raros de Extension-B (de 4 bytes) se cuentan correctamente.
- Diccionario incluido localmente. El diccionario CJK va dentro del paquete de la página: sin llamada de red, sin clave de API, nada sale de tu navegador.
Ejemplo práctico#
Escribe 你好世界 («hola mundo»):
Symbol: nǐ hǎo shì jiè
Num: ni3 hao3 shi4 jie4
None: ni hao shi jie
Polyphones: 好 → hǎo / hào
La tabla de polifonos ya señala 好, que tiene dos lecturas (hǎo, «bueno», y hào, «gustar de»). Aquí el motor eligió correctamente hǎo por el contexto; la tabla está para que veas las alternativas y la sobrescribas cuando el contexto sea inusual.
Ahora prueba 重庆 (la ciudad de Chongqing). Aquí el motor lee 重 como chóng, no como el más frecuente zhòng:
Symbol: chóng qìng
Num: chong2 qing4
None: chong qing
Polyphones: 重 → chóng / zhòng
Para ver el modo apellido en acción, escribe 单先生 («Sr. Shan»). Con la casilla desmarcada, el motor lee 单 con su dān por defecto; marca Modo apellido y pasa a la lectura de apellido shàn:
Surname off: dān xiān shēng
Surname on: shàn xiān shēng
Preguntas frecuentes#
¿Por qué el mismo carácter a veces tiene dos lecturas?#
Porque es un polifono (多音字): una forma escrita, varias formas habladas, que se eligen según la palabra en la que aparezca. 的 se lee de 4 maneras: de ( posesivo 的), dí (的确 «en efecto»), dì (目的 «propósito»), dī (的士 «taxi»). El motor elige la lectura más probable a partir del contexto circundante, y la tabla de polifonos muestra las alternativas para que puedas sobrescribirla cuando el contexto sea inusual.
¿Qué formato de tono debería usar?#
Depende de adónde vaya el texto. Las marcas de tono son adecuadas para la pantalla orientada a humanos y para todo lo que lean estudiantes. Los números de tono son lo que esperan los sistemas de búsqueda antiguos, algunos formatos de importación de tarjetas de estudio y el código de ordenación por pinyin. Sin tonos encaja en casos donde el tono es irrelevante: nombres de archivo romanizados, slugs de URL, un índice fonético aproximado. Esta página te da los tres para que no tengas que convertir dos veces.
¿Admite el cantonés u otros dialectos?#
No, esta herramienta transcribe únicamente pinyin de mandarín (Putonghua). El jyutping del cantonés, el bopomofo taiwanés (zhuyin) y otras romanizaciones son sistemas aparte con sus propios diccionarios. Si necesitas cambiar un texto entre caracteres simplificado y tradicional en lugar de transcribir su sonido, usa el conversor simplified-traditional.
¿Qué cuenta realmente el contador de caracteres?#
Cuenta puntos de código Hanzi (ideogramas chinos), no bytes ni unidades UTF-16, y gestiona correctamente los caracteres de 4 bytes del plano suplementario. 你好 cuenta como 2, y lo mismo un par de caracteres raros de Extension-B que el string.length de JavaScript reportaría como 4. La puntuación y el texto latino de tu entrada los ignora el contador.