Series 2 · 第 9 篇——多重反切與韻書 上一篇:Candidate Ranking:Quizzman Fanqie Engine 如何處理多個反切
為什麼一個漢字會有多個反切?正確認識古代韻書的形成
初學反切時,許多人都會產生一個很自然的疑問:「如果一個漢字只有一種讀音,為什麼會有多個反切?」 有些字在《廣韻》中只有一個反切,到了《集韻》卻又增加了新的反切,而《康熙字典》更引用了許多不同來源。這讓不少人誤以為各部韻書彼此矛盾。事實正好相反。多個反切的存在並不是錯誤,而是漢語歷史演變以及歷代韻書編纂過程的真實反映。
首先,需要了解什麼是反切?
古代韻書並不像今天使用 IPA 那樣直接標示發音。
相反地,古人採用了反切(反切法)來表示字音。
例如:
德紅切
意思就是:
- 取「德」的聲母;
- 取「紅」的韻母與聲調。
藉由這兩個字,當時的人便能推導出目標字的讀音。
因此,
反切是一種描述讀音的方法,
而不是直接拼音。
一個漢字,不一定只有一種讀音
首先需要改變一個非常普遍的觀念。
很多人認為:
一個漢字
↓
一種讀音
但在漢語歷史中,
這幾乎從來都不是事實。
一個字可能:
- 具有不同詞義;
- 屬於不同詞性;
- 流行於不同地區;
- 經歷不同時代的語音演變。
因此,
出現多個讀音是十分正常的現象。
直到今天,
普通話仍然保留大量多音字,例如:
- 行
- 長
- 樂
- 重
這種現象自古便已存在。
韻書並非同一時期編纂
另一個重要原因是:
各部韻書並不是同時完成的。
例如:
| 韻書 | 時代 | |------|------| | 《切韻》 | 隋代 | | 《唐韻》 | 唐代 | | 《廣韻》 | 北宋 | | 《集韻》 | 北宋 | | 《韻會》 | 元代 | | 《康熙字典》 | 清代 |
這些典籍之間,
往往相隔數百年。
在這段期間:
- 漢語持續演變;
- 韻類逐漸調整;
- 新資料不斷補充。
因此,
同一個字擁有多個反切,
其實十分自然。
每部韻書的編纂目的不同
並非所有韻書,
都是為了重建同一套語音系統。
例如:
《廣韻》
主要承襲《切韻》的傳統,
作為中古音的重要標準。
而《集韻》
則希望進一步擴充資料,
新增:
- 異讀;
- 異體;
- 更多未收錄的反切。
因此,
某個字在《集韻》比《廣韻》擁有更多反切,
並不是互相矛盾,
而是資料更加完整。
《康熙字典》並沒有創造新的反切
這也是最容易產生誤解的地方。
許多人以為:
《康熙字典》中的反切,
都是清代編者自行制定的。
事實並非如此。
《康熙字典》的主要工作是:
- 彙整;
- 引用;
- 比較不同來源。
在許多字條中,
都會清楚標示反切出處,例如:
《廣韻》
↓
……
《集韻》
↓
……
《唐韻》
↓
……
對 Quizzman Fanqie Engine 而言,
這些來源資訊極為重要。
多個反切,不一定代表多種讀音
這也是初學者最容易誤解的地方。
假設某個字同時有:
AB切
以及:
CD切
這並不表示
一定存在兩種完全不同的發音。
很多時候,
不同反切仍然描述的是同一個中古音音系。
例如,
兩個下字不同,
但:
- 屬於同一韻;
- 同一聲調;
- 同一開合;
- 同一等。
此時,
重建結果幾乎完全一致。
換句話說:
反切可以不同,
Middle Chinese Profile 卻可能完全相同。
當然,也確實存在真正不同的情況
並不是所有反切,
最後都會得到同一結果。
有些反切確實反映:
- 古讀;
- 新讀;
- 異讀;
- 不同詞義;
- 不同語音傳統。
這些資料,
對歷史語言研究具有極高價值。
因此,
Quizzman Fanqie Engine 並不會直接捨棄。
相反地,
Engine 保留所有可能性。
為什麼 Quizzman 不直接選第一個反切?
如果 Parser 僅採用第一個反切,
流程將變成:
Character
↓
第一個 Fanqie
↓
Engine
這種方式十分簡單,
卻會遺失大量學術資訊。
因此,
Quizzman 建立了一個完整的候選空間:
Character
↓
Fanqie A
↓
Fanqie B
↓
Fanqie C
↓
Fanqie D
每個反切,
都會獨立分析。
必要時,
建立不同的 Middle Chinese Profile。
最後,
再由 Candidate Ranking 判斷最適合的候選結果。
多個反切,是歷史留下的證據
換個角度來看:
每一個反切,
都像是一張在不同時代拍攝的照片。
若只保留一個反切,
我們只剩下一張照片。
若保留全部,
便能觀察同一個字在數百年間的語音變化。
這正是歷史語言學最珍貴的資料。
Quizzman Fanqie Engine 也採用了這種思路。
從反切到 Middle Chinese Profile
Quizzman 的另一個重要設計理念是:
Engine 並不把反切視為最終結果。
每一個反切,
都只是輸入資料。
經過 Parser 後,
反切會轉換成:
- 聲母;
- 韻;
- 攝;
- 等;
- 開口/合口;
- 聲調;
- Middle Chinese Profile。
真正供後續演算法使用的,
正是這些音韻屬性。
因此,
即使兩個反切不同,
只要最後形成相同的 Middle Chinese Profile,
後續流程便幾乎沒有差異。
多個反切,不是應該消除的問題
在軟體工程中,
重複資料通常需要消除。
但在歷史語言學中,
多個反切反而是一項極其珍貴的資訊。
它們反映了:
- 漢語歷史的演變;
- 韻書之間的承襲關係;
- 不同時代記錄的異讀;
- 古代學者對語音系統的觀察。
因此,
Quizzman Fanqie Engine 並不把這些資料視為「雜訊」。
相反地,
每一個反切,
都是歷史拼圖中的一塊。
Engine 不會試圖消除這種多樣性,
而是透過演算法分析、比較與評估所有反切,
最後再選出最合適的候選結果。
這正是 Candidate Ranking 的核心思想,
也是 Quizzman Fanqie Engine 與傳統漢越音查詢工具最大的差異之一。