企评社

中文转拼音

汉字 → 带声调 / 数字声调 / 无声调 / 首字母 · 多音字按词组判断 · 可自定义读音

词典在浏览器本地运行,文本不上传、刷新即清空

要转换的中文

0 字符

夹带的英文、数字、标点、emoji 默认原样保留(可在下面关掉);单次建议不超过 20 万字符。

输出模式

转换结果

等待输入

逐字对照表只列汉字

原文 带声调 数字声调 无声调 首字母 其它读音
还没有内容

对照表最多显示前 2000 个汉字,完整的用「下载 CSV」。

自定义读音(多音字纠正)

每行一条,写成「词=拼音」,拼音用带声调的字母写法(例如 重庆=chóng qìng)。自定义优先于内置词典:定义了单字「重=zhòng」会连「重庆」一起改掉,所以建议直接定义词组。

输出规则与已知边界

模式「中文」的输出适合
带声调zhōng wén注音、教学、给汉字标音
数字声调zhong1 wen2程序处理、排序与检索
无声调zhong wen做 URL、文件名、检索键
首字母z w缩写、首字母检索

多音字:默认按词组上下文取音(重庆 chóng qìng、重量 zhòng liàng、银行 yín háng、长大 zhǎng dà),词组词典在本地;脱离词组只能取常用读音(单独的「重」读 zhòng)。词典并非完美:个别词条会取音不准(实测「行长」会被读成 háng cháng),遇到这种直接用下面的「自定义读音」指定即可。开启「列出全部读音」会把多个读音并列输出。

逐词分隔:用自带的本地小词典切词,词内不加分隔符、词间加分隔符。词典覆盖有限——常用词(重庆 / 银行 / 音乐)会成组,未收录的词(例如「你好」)仍会被逐字切开,所以逐词结果有时与逐字接近;切分只决定分隔位置,读音不受影响,边界对不上时会自动回退成逐字分隔。

空白与换行:原文里的空格、换行、制表符都原样保留;它们同样算「非汉字」,两侧各会有一个分隔符,所以输出里可能出现连续空格。想要更干净的结果,可以关掉「保留非汉字」或把分隔符设为「无」。

ü 与 v:只有无声调、数字声调模式支持 ü → v(女绿 → nv lv)。带声调模式保持 ǚ / ǜ,该模式下不提供这个开关。

变调:默认按普通话习惯处理「一 / 不」的变调(一个 → yí gè、不是 → bú shì);关掉后输出本调(yī gè、bù shì)。三声连读变调不做(你好 输出 nǐ hǎo)。

生僻字与库边界:读音来自本地词典,生僻字按库内数据(龘 dá、靐 bìng、齉 nàng);词典覆盖不到的字符会原样保留。emoji、日文假名、其它符号都不是汉字,按「非汉字」处理。

常见问题

多音字是怎么判断的?准不准?

默认按词组上下文判断:例如「重庆」读 chóng qìng、「重量」读 zhòng liàng、「银行」读 yín háng、「长大」读 zhǎng dà——这些靠内置词组词典在本地完成,不联网。脱离词组时只能取常用读音(单独的「重」读 zhòng),所以把词写完整、别把词语拆开,判断会明显更准。开启「列出全部读音」后,输出会把这个字的多个读音都列出来(重 → zhòng chóng),方便你自己确认。

自定义读音怎么写?会覆盖内置读音吗?

每行一条,写成「词=拼音」,拼音要用带声调的字母写法(如 重庆=chóng qìng),不能用数字声调(zhong4)——词典只认带声调的写法。自定义的优先级高于内置词组:如果你定义了单字「重=zhòng」,「重庆」也会跟着变成 zhòng qìng,所以更推荐直接定义词组「重庆=chóng qìng」。解析失败的行会逐行报错且不生效;点「恢复默认读音」可以清空全部自定义。

带声调、数字声调、无声调、首字母有什么区别?ü 写成 v 呢?

以「中文」为例:带声调是 zhōng wén(适合注音、教学、给汉字标音),数字声调是 zhong1 wen2(适合程序处理、排序与检索),无声调是 zhong wen,首字母是 z w(适合做缩写与首字母检索)。ü 写成 v 只在无声调与数字声调下有效:女绿 → nv lv;带声调模式会保持 ǚ / ǜ 不转换,本工具在该模式下不提供这个开关(转换后的写法不规范)。

会上传文本吗?能处理多长的文本?

不会。词典与转换全部在你的浏览器里运行,文本不出本机、刷新即清空,页面不发起任何网络请求,也没有第三方 CDN 依赖。单次建议不超过 20 万字符(超出会提示分段处理),实测 10 万汉字约 150 毫秒完成;转换是纯本地字符串运算,不吃服务器资源。长文里夹带的英文、数字、标点、emoji 不是汉字,默认原样保留,也可以关掉「保留非汉字」只输出拼音。

相关工具