Quizzman Fanqie Engine 系列 — 第 12 篇。上一篇:開發歷程 · V6
從 Middle Chinese 到拼音與漢越音:為什麼 Quizzman Fanqie Engine 能從同一份資料生成多種讀音系統?
現今大多數工具都只針對單一目標而設計。漢越音工具只能生成漢越音,拼音工具只能生成拼音,因此每套系統都必須維護自己的規則與資料庫,也難以擴展到其他語言。Quizzman Fanqie Engine 採用了完全不同的架構。它並不把漢越音或拼音視為起點,而是將 Middle Chinese(中古漢語) 作為整個系統最重要的中介層。從同一份 Middle Chinese 音韻資料出發,Engine 可以推導出不同的讀音系統。因此,Quizzman Fanqie Engine 不只是漢越音引擎,更是一個歷史音韻計算平台。
一個漢字不只有一種讀音
對多數學習中文或漢越音的人而言,一個漢字通常只有一種讀法。
例如:
| 漢字 | 漢越音 | 拼音 | |------|---------|-------| | 國 | quốc | guó | | 學 | học | xué | | 德 | đức | dé |
因此,很多人認為:
漢越音與拼音是兩套彼此獨立的系統。
事實並非如此。
兩者其實都源自同一個共同祖先。
那就是 Middle Chinese(中古漢語)。
Middle Chinese 才是核心
在 Quizzman Fanqie Engine 的架構中,不存在:
漢字
↓
漢越音
也不存在:
漢字
↓
拼音
所有流程都必須經過同一層中介。
漢字
↓
反切
↓
Middle Chinese
↓
現代讀音系統
這表示:
漢越音與拼音並不是彼此獨立生成。
它們都是由同一份 Middle Chinese 音韻資料推導而來。
Middle Chinese 音韻資料包含哪些內容?
完成反切分析之後,Engine 會建立一份完整的音韻資料。
例如:
| 項目 | 值 | |------|----| | 聲母 | 幫 | | 韻 | 東 | | 攝 | 通 | | 等 | 一等 | | 開合 | 開口 | | 聲調 | 平聲 |
這就是一個音節的「DNA」。
生成不同讀音系統所需的全部資訊,都已經包含在這份資料之中。
為什麼要這樣設計?
假設沒有 Middle Chinese 這一層。
Engine 就必須分別建立:
- 漢越音規則
- 拼音規則
兩套系統幾乎無法共享任何內容。
如果日後想新增:
- 漢音(Kan-on)
- 吳音(Go-on)
- 韓漢音
- 或其他漢語方言
幾乎所有工作都必須重新開始。
這樣的架構非常難以擴充。
一個中介層,對應多種輸出
Quizzman Fanqie Engine 的解決方式,就是讓 Middle Chinese 成為整個系統的核心。
Middle Chinese
/ | \
/ | \
▼ ▼ ▼
漢越音 拼音 其他讀音系統
因此,所有讀音系統都共享同一份歷史音韻資料。
只要 Middle Chinese 的分析更加完善,
所有讀音系統都能同步受益。
生成漢越音
生成漢越音時,Engine 會依序套用:
- 聲母規則
- 韻母規則
- 十六攝規則
- 開口規則
- 合口規則
- Eight Tone Slot
- Lexical Normalization
最後得到漢越音。
例如:
Middle Chinese
↓
quốc
生成拼音
對於現代普通話,
Engine 不會使用漢越音規則。
而是套用普通話歷史演變規律,例如:
- 聲母歷史演變
- 入聲消失
- 多個韻部合流
- 聲調的不同演化
因此得到:
Middle Chinese
↓
guó
雖然結果不同,
但漢越音與拼音都源自同一份 Middle Chinese 音韻資料。
兩種語言,兩條演化路徑
有趣的是:
漢越音與拼音並不是彼此翻譯。
它們是同一祖先演化出的兩條不同分支。
Middle Chinese
│
┌──────────┴──────────┐
▼ ▼
漢越音 現代普通話
│ │
quốc guó
不存在:
quốc
↓
guó
或:
guó
↓
quốc
兩者都是獨立地從 Middle Chinese 演變而來。
為什麼漢越音保留了更多古代特徵?
有趣的是,
許多情況下,
漢越音仍保留了普通話早已消失的歷史特徵。
例如:
法
↓
pháp
仍保留:
-p
但普通話:
fǎ
已完全失去塞音韻尾。
同樣的情況也出現在:
- 德 → đức
- 國 → quốc
- 學 → học
因此,
漢越音在歷史語言研究中具有極高價值。
不只是漢越音與拼音
有了 Middle Chinese 這一層之後,
要擴充新的讀音系統就容易得多。
理論上,同一份音韻資料還可以生成:
Middle Chinese
↓
漢音(Kan-on)
Middle Chinese
↓
吳音(Go-on)
Middle Chinese
↓
韓漢音
Middle Chinese
↓
各種漢語方言
每一種讀音系統,
只需要建立自己的 Projection 規則即可。
整個 Engine 不需要重新設計。
面向平台的架構
這也是 Quizzman Fanqie Engine 並非單一應用程式的原因。
它被設計成一個 Phonological Platform。
Middle Chinese 扮演的是一種「中介語言」。
各種讀音系統,
只是建立在這個中介層上的不同 Projection。
這樣的設計可以:
- 減少規則重複
- 更容易測試
- 更容易擴充
- 更容易維護
- 更容易進行學術研究
不只是查詢工具
當 Middle Chinese 成為核心資料之後,
Engine 的用途便遠遠超越查詢工具。
同一份音韻資料還可以應用於:
- 音韻學研究
- 反切分析
- 歷史字典建構
- 漢文文本處理
- NLP
- AI
- OCR
- 古音重建
因此,
Quizzman Fanqie Engine 被定位為一個歷史音韻計算平台,
而不只是漢越音查詢工具。
為未來而設計的架構
這套架構最大的優勢,
並不在於目前支援多少種讀音系統。
真正的優勢在於它的可擴充性。
當需要新增新的讀音系統時,
開發團隊不必重寫整個 Engine。
只需要建立新的 Projection Layer,
即可從同一份 Middle Chinese 音韻資料推導新的結果。
這也是 Quizzman Fanqie Engine 始終堅持的核心理念:
一份 Middle Chinese 音韻資料,多種讀音系統(One Middle Chinese Profile, Multiple Reading Systems)。
正因如此,Quizzman Fanqie Engine 得以持續演進,逐步成為服務於東亞歷史語言研究的計算平台,而不僅僅停留在漢越音或拼音生成工具。