Series 2 · 第 9 篇——多重反切与韵书 上一篇:Candidate Ranking:Quizzman Fanqie Engine 如何处理多个反切
为什么一个汉字会有多个反切?正确认识古代韵书的形成
初学反切时,许多人都会产生一个很自然的疑问:「如果一个汉字只有一种读音,为什么会有多个反切?」 有些字在《广韵》中只有一个反切,到了《集韵》却又增加了新的反切,而《康熙字典》更引用了许多不同来源。这让不少人误以为各部韵书彼此矛盾。事实正好相反。多个反切的存在并不是错误,而是汉语历史演变以及历代韵书编纂过程的真实反映。
首先,需要了解什么是反切?
古代韵书并不像今天使用 IPA 那样直接标示发音。
相反地,古人采用了反切(反切法)来表示字音。
例如:
德红切
意思就是:
- 取「德」的声母;
- 取「红」的韵母与声调。
借由这两个字,当时的人便能推导出目标字的读音。
因此,
反切是一种描述读音的方法,
而不是直接拼音。
一个汉字,不一定只有一种读音
首先需要改变一个非常普遍的观念。
很多人认为:
一个汉字
↓
一种读音
但在汉语历史中,
这几乎从来都不是事实。
一个字可能:
- 具有不同词义;
- 属于不同词性;
- 流行于不同地区;
- 经历不同时代的语音演变。
因此,
出现多个读音是十分正常的现象。
直到今天,
普通话仍然保留大量多音字,例如:
- 行
- 长
- 乐
- 重
这种现象自古便已存在。
韵书并非同一时期编纂
另一个重要原因是:
各部韵书并不是同时完成的。
例如:
| 韵书 | 时代 | |------|------| | 《切韵》 | 隋代 | | 《唐韵》 | 唐代 | | 《广韵》 | 北宋 | | 《集韵》 | 北宋 | | 《韵会》 | 元代 | | 《康熙字典》 | 清代 |
这些典籍之间,
往往相隔数百年。
在这段期间:
- 汉语持续演变;
- 韵类逐渐调整;
- 新资料不断补充。
因此,
同一个字拥有多个反切,
其实十分自然。
每部韵书的编纂目的不同
并非所有韵书,
都是为了重建同一套语音系统。
例如:
《广韵》
主要承袭《切韵》的传统,
作为中古音的重要标准。
而《集韵》
则希望进一步扩充资料,
新增:
- 异读;
- 异体;
- 更多未收录的反切。
因此,
某个字在《集韵》比《广韵》拥有更多反切,
并不是互相矛盾,
而是资料更加完整。
《康熙字典》并没有创造新的反切
这也是最容易产生误解的地方。
许多人以为:
《康熙字典》中的反切,
都是清代编者自行制定的。
事实并非如此。
《康熙字典》的主要工作是:
- 汇整;
- 引用;
- 比较不同来源。
在许多字条中,
都会清楚标示反切出处,例如:
《广韵》
↓
……
《集韵》
↓
……
《唐韵》
↓
……
对 Quizzman Fanqie Engine 而言,
这些来源资讯极为重要。
多个反切,不一定代表多种读音
这也是初学者最容易误解的地方。
假设某个字同时有:
AB切
以及:
CD切
这并不表示
一定存在两种完全不同的发音。
很多时候,
不同反切仍然描述的是同一个中古音音系。
例如,
两个下字不同,
但:
- 属于同一韵;
- 同一声调;
- 同一开合;
- 同一等。
此时,
重建结果几乎完全一致。
换句话说:
反切可以不同,
Middle Chinese Profile 却可能完全相同。
当然,也确实存在真正不同的情况
并不是所有反切,
最后都会得到同一结果。
有些反切确实反映:
- 古读;
- 新读;
- 异读;
- 不同词义;
- 不同语音传统。
这些资料,
对历史语言研究具有极高价值。
因此,
Quizzman Fanqie Engine 并不会直接舍弃。
相反地,
Engine 保留所有可能性。
为什么 Quizzman 不直接选第一个反切?
如果 Parser 仅采用第一个反切,
流程将变成:
Character
↓
第一个 Fanqie
↓
Engine
这种方式十分简单,
却会遗失大量学术资讯。
因此,
Quizzman 建立了一个完整的候选空间:
Character
↓
Fanqie A
↓
Fanqie B
↓
Fanqie C
↓
Fanqie D
每个反切,
都会独立分析。
必要时,
建立不同的 Middle Chinese Profile。
最后,
再由 Candidate Ranking 判断最适合的候选结果。
多个反切,是历史留下的证据
换个角度来看:
每一个反切,
都像是一张在不同时代拍摄的照片。
若只保留一个反切,
我们只剩下一张照片。
若保留全部,
便能观察同一个字在数百年间的语音变化。
这正是历史语言学最珍贵的资料。
Quizzman Fanqie Engine 也采用了这种思路。
从反切到 Middle Chinese Profile
Quizzman 的另一个重要设计理念是:
Engine 并不把反切视为最终结果。
每一个反切,
都只是输入资料。
经过 Parser 后,
反切会转换成:
- 声母;
- 韵;
- 摄;
- 等;
- 开口/合口;
- 声调;
- Middle Chinese Profile。
真正供后续演算法使用的,
正是这些音韵属性。
因此,
即使两个反切不同,
只要最后形成相同的 Middle Chinese Profile,
后续流程便几乎没有差异。
多个反切,不是应该消除的问题
在软体工程中,
重复资料通常需要消除。
但在历史语言学中,
多个反切反而是一项极其珍贵的资讯。
它们反映了:
- 汉语历史的演变;
- 韵书之间的承袭关系;
- 不同时代记录的异读;
- 古代学者对语音系统的观察。
因此,
Quizzman Fanqie Engine 并不把这些资料视为「杂讯」。
相反地,
每一个反切,
都是历史拼图中的一块。
Engine 不会试图消除这种多样性,
而是透过演算法分析、比较与评估所有反切,
最后再选出最合适的候选结果。
这正是 Candidate Ranking 的核心思想,
也是 Quizzman Fanqie Engine 与传统汉越音查询工具最大的差异之一。