Series 2 · 第 12 篇──語言本體(Middle Chinese Hub)。上一篇:為什麼 Quizzman 不使用 AI 自行學習音韻規律
Quizzman Fanqie Engine 與語言本體(Ontology):當漢越音、拼音與中古漢語屬於同一知識體系
對許多人而言,Quizzman Fanqie Engine 只是把反切轉換成漢越音或漢語拼音的工具。然而,這只是整個專案極小的一部分。Fanqie Engine 最重要的價值,在於建立一套 Ontology(本體),使每一個漢字不再只是字典中的一筆資料,而是一個與多種音系、多種語言及多個歷史層次互相連結的知識節點。換句話說,Fanqie Engine 不只是讓電腦「讀出」漢字,更讓電腦理解不同讀音彼此之間的關係。
傳統字典如何儲存資料?
目前大部分電子字典都採用十分直接的方式。
例如:
學
↓
học
↓
xué
↓
study
或:
| 漢字 | 漢越音 | 拼音 | |------|---------|-------| | 學 | học | xué | | 國 | quốc | guó | | 明 | minh | míng |
這種方式非常適合查詢。
但存在一個限制。
電腦只知道:
「學」具有漢越音 học,也具有拼音 xué。
電腦並不知道為什麼這兩種讀音彼此相關。
事實上,漢越音與拼音並非各自獨立產生
若仔細觀察便會發現:
漢越音與現代普通話並不是兩套毫無關聯的系統。
它們共同來自同一個祖先:
Middle Chinese(中古漢語)。
可以把演變理解為:
Middle Chinese
│
▼
漢越音
│
▼
học
同時:
Middle Chinese
│
▼
Mandarin(現代官話)
│
▼
xué
因此:
漢越音並不是由拼音演變而來;
拼音也不是由漢越音演變而來。
兩者都是由同一套歷史音系分化出的不同分支。
這正是 Quizzman Fanqie Engine 最重要的設計理念。
Middle Chinese 是整個 Ontology 的核心節點
在 Quizzman 的 Ontology(本體) 中,
漢字不會直接連結到漢越音或拼音。
Engine 會先建立一份 Middle Chinese Profile(中古漢語音系描述)。
例如:
學
│
▼
Middle Chinese Profile
其中包含:
- 聲母
- 韻
- 攝
- 等
- 開口/合口
- 聲調
- 反切
- 重建音標
建立完成後,
Engine 才開始推導其他音系。
一份 Middle Chinese Profile 可以推導多種讀音系統
當 Middle Chinese Profile 建立完成後,
Engine 可以投射(Projection)到不同語言系統。
例如:
Middle Chinese
│
├────► 漢越音
│
└────► 拼音
未來還可繼續擴充:
- Kan-on(日本漢音)
- Go-on(吳音)
- Tō-on(唐音)
- 韓國漢字音(Hanja Reading)
- 各種漢語方言
- 其他歷史重建系統
因此 Fanqie Engine 並非僅服務於漢越音,而是一個可共用的音韻平台。
每一個漢字都是一個知識節點
在 Ontology 中,
漢字不再只是 Unicode 字元。
它是一個 Node(節點)。
例如:
Unicode
│
│
Meaning ──── 學 ─── Radical
│
│
Middle Chinese
╱ ╲
╱ ╲
漢越音 拼音
╲ ╱
╲ ╱
Historical Sources
此節點可以同時連結:
- Unicode
- 部首
- 字義
- 反切
- Middle Chinese
- 漢越音
- 拼音
- 異體字
- 各歷史讀音層
- 韻書來源
每一條連結都具有明確的語言學意義。
透過演算法建立漢越音與拼音的關聯
Fanqie Engine 最重要的特點之一,就是:
並不直接儲存漢越音與拼音之間的對應。
它們之間的關係完全由演算法推導。
例如:
反切
│
▼
Middle Chinese
│
├────► Projection HV
│
└────► Projection PY
因此,
Engine 知道:
學
│
├──► học
│
└──► xué
是由同一份 Middle Chinese Profile 推導而來。
而不是資料庫裡兩筆彼此獨立的紀錄。
Ontology 讓電腦真正理解資料
若只有字典,
電腦只知道:
國 → quốc
國 → guó
而在 Ontology 中,
電腦還知道:
- 兩種讀音來自同一份 Middle Chinese Profile。
- 它們具有相同歷史聲母。
- 屬於相同韻部。
- 擁有相同歷史聲調。
- 差異僅來自不同語言各自的音變規律。
這些知識,是一般查詢表無法表示的。
不只是查詢工具
這樣的 Ontology 可支援許多應用。
依讀音搜尋
即使使用者只知道:
quốc
Engine 仍可找到:
國
並同時提供:
- guó
- Middle Chinese Profile
- 歷史音韻資訊
多語言連結
同一漢字可同時連結:
- 漢越音
- 拼音
- Kanji
- Hanja
- 各歷史讀音層
這對 Sino-Xenic(漢字文化圈借詞音)研究尤其重要。
發現音韻關係
Engine 不只知道兩個字是否同音,
還知道:
- 是否同一聲母。
- 是否同一韻部。
- 是否因同一歷史來源而相似。
- 或只是現代越南語中的偶然同音。
這些都是歷史語言研究的重要資訊。
Fanqie Engine 是 Quizzman 的基礎設施
從系統架構角度來看,
Fanqie Engine 並不是最終產品。
它是一層 Infrastructure Layer(基礎設施層)。
Quizzman 其他產品,例如:
- 漢越字典
- 拼音查詢
- 反切分析工具
- 音韻研究平台
- 語音搜尋系統
- AI 漢字學習工具
皆可共用同一套由 Fanqie Engine 建立的 Ontology。
因此所有產品共享同一知識來源,而不需要維護多份彼此獨立的資料庫。
從推導工具走向知識平台
Quizzman Fanqie Engine 最初的目標,是根據反切推導漢越音。
隨著專案發展,它逐漸擴展成更大的方向:
建立一套以 Middle Chinese(中古漢語)為核心的語言 Ontology(本體)。
在這套模型中,
漢越音與拼音不再是兩筆人工對應的資料,
而是由同一份歷史音系推導出的不同結果。
正因如此,
Fanqie Engine 不只回答:
「這個字怎麼讀?」
更能回答:
「不同讀音系統之間為什麼彼此相關?」
這也是 Quizzman 的長期目標:
以 Fanqie Engine 為基礎,建立一套完整的 漢字 Ontology(漢字本體),讓每一個漢字都能與其歷史音韻、字義、韻書來源及東亞各語言讀音,共同組成一張統一且可推理的知識網路。