公安部户政管理研究中心发布的 2021 年全国姓名报告里,男性新生儿高频姓名同时出现了“沐宸”和“沐辰”。宸与辰不是同一个字,普通话却都读 chén。两组名字的带调拼音都是 Mùchén;去掉调号以后,又都变成 Muchen。
拼音在这里没有写错。它记录普通话读音,汉字还保留书写和意义。同一个读音可以对应多个汉字,一串拉丁字母便不能像产品编号那样反推出唯一姓名。
沐宸和沐辰都写作 Mùchén
两组名字的差异藏在末字里。“辰”可以让人想到时日、星辰等用法;“宸”有自己的历史字义和姓名联想。家庭为什么选用其中一个字,要看本人姓名和命名背景,不能从 Mùchén 单独推出。
姓名学者 Zhu Binbin 和 Julie Millward 讨论过这种信息损失。汉语有大量同音字,姓名转成以声音为基础的罗马字母形式后,原有汉字的区别会消失。他们举到姓氏 Yu:只算同一个阳平读音,已经至少有五个不同姓氏汉字。调号缩小了范围,仍未必留下唯一答案。
名字的具体含义属于汉字与组合,可见怎样理解一个中文名字的含义。这里需要分清的是,姓名的声音相同,不等于写法和含义相同。
无声调的 Muchen 又少了一层信息
普通话音节通常由声母、韵母和声调组成。yī、yí、yǐ、yì 的字母主体都是 yi,声调不同。英语文章、邮箱或数据库拿掉调号后,这四个读音在页面上都会显示为 yi。
这和“宸/辰”是两层问题。无调 Yi 先合并了不同声调;chén 则连声母、韵母、声调都相同,保留调号也分不开两个字。声调符号能减少前一种歧义,不能消除后一种同音字。
国家拼音正词法还规定,声调写字的原调,不跟随连读时的变调。姓名在口语中出现音高变化,正式拼音仍保留稳定的词汇声调,不会为每一次实际语流改写。
空格能分开姓和名,不能找回汉字
中国人名拼音规则要求姓和名分写,姓和名的开头字母大写,双字给定名内部连写。例如 Wáng Jiànguó 中,Wáng 是姓,Jiànguó 是名。
空格保存的是姓名结构,不是汉字字形。知道 Li 是姓,仍可能不知道它对应李、黎,还是另一个实际采用的姓氏字;若页面省略声调,不同声调的姓又会合并。大小写也补不回这些区别。
拼音名在不同语言环境里的排列方式属于另一个问题,详见中国人的姓为什么放在名字前面。顺序发生变化,原姓名的汉字并不会跟着改变。
准确识别人名要回到本人和记录
计算语言学家 Kui-Lam Kwok 和 Peter Deng 研究英语文本里的拼音姓名还原时,必须把姓名数据库、候选使用概率和语料上下文一起纳入。拼音提供了读音范围,系统要从其他材料补充身份信息。
学术出版中的作者姓名更容易暴露实际后果。不同作者可能使用相同拼音,同一个人的姓名又可能因顺序、缩写或旧式转写出现不同版本。相关研究建议结合中文字符、工作单位、研究主题和 ORCID 等持续标识符。单凭字母串归并论文,可能把两个人合在一起,也可能把一个人拆成几个。
日常见面时,想知道名字怎样写,可以请本人给出汉字,或照着本人提供的名片、邮件签名和资料页记录。正式事务以证件和权威系统字段为准。只有拼音而没有本人确认,最准确的说法往往是:现在还不知道具体是哪几个字。
全国姓名报告能证明“沐宸”和“沐辰”都真实存在,不能证明眼前某个 Muchen 一定采用其中之一。一个汉字也可能有多个读音,姓名中的实际读法仍应由本人或可靠记录确认。
拼音帮助人们读出普通话姓名,也在汉字不便使用时提供规范的罗马字母形式。要确认姓名是哪几个字,以及这些字在名字里怎样理解,仍要回到本人使用的汉字和可靠身份记录。
来源与延伸阅读
- 教育部:《汉语拼音方案》
- GB/T 28039—2011《中国人名汉语拼音字母拼写规则》
- GB/T 16159—2012《汉语拼音正词法基本规则》
- Zhu 与 Millward:Personal Names in Chinese
- Kwok 与 Deng:Corpus-Based Pinyin Name Resolution
- Cao、Xu 与 Iso-Sipila:Linguistic and Acoustic Analysis of Chinese Person Names
- 公安部户政管理研究中心:《二〇二一年全国姓名报告》
- Xu 与 Hu:Rethinking the Author Name Ambiguity Problem and Beyond
