Quizzman Fanqie Engine 與語言本體(Ontology):當漢越音、拼音與中古漢語屬於同一知識體系

Series 2 · 第 12 篇──語言本體(Middle Chinese Hub)。上一篇:為什麼 Quizzman 不使用 AI 自行學習音韻規律

Quizzman Fanqie Engine 與語言本體(Ontology):當漢越音、拼音與中古漢語屬於同一知識體系

對許多人而言,Quizzman Fanqie Engine 只是把反切轉換成漢越音或漢語拼音的工具。然而,這只是整個專案極小的一部分。Fanqie Engine 最重要的價值,在於建立一套 Ontology(本體),使每一個漢字不再只是字典中的一筆資料,而是一個與多種音系、多種語言及多個歷史層次互相連結的知識節點。換句話說,Fanqie Engine 不只是讓電腦「讀出」漢字,更讓電腦理解不同讀音彼此之間的關係


傳統字典如何儲存資料?

目前大部分電子字典都採用十分直接的方式。

例如:

學
 ↓
học
 ↓
xué
 ↓
study

或:

| 漢字 | 漢越音 | 拼音 | |------|---------|-------| | 學 | học | xué | | 國 | quốc | guó | | 明 | minh | míng |

這種方式非常適合查詢。

但存在一個限制。

電腦只知道:

「學」具有漢越音 học,也具有拼音 xué。

電腦並不知道為什麼這兩種讀音彼此相關。


事實上,漢越音與拼音並非各自獨立產生

若仔細觀察便會發現:

漢越音與現代普通話並不是兩套毫無關聯的系統。

它們共同來自同一個祖先:

Middle Chinese(中古漢語)。

可以把演變理解為:

Middle Chinese
        │
        ▼
     漢越音
        │
        ▼
      học

同時:

Middle Chinese
        │
        ▼
    Mandarin(現代官話)
        │
        ▼
       xué

因此:

漢越音並不是由拼音演變而來;

拼音也不是由漢越音演變而來。

兩者都是由同一套歷史音系分化出的不同分支

這正是 Quizzman Fanqie Engine 最重要的設計理念。


Middle Chinese 是整個 Ontology 的核心節點

在 Quizzman 的 Ontology(本體) 中,

漢字不會直接連結到漢越音或拼音。

Engine 會先建立一份 Middle Chinese Profile(中古漢語音系描述)

例如:

學
 │
 ▼
Middle Chinese Profile

其中包含:

  • 聲母
  • 開口/合口
  • 聲調
  • 反切
  • 重建音標

建立完成後,

Engine 才開始推導其他音系。


一份 Middle Chinese Profile 可以推導多種讀音系統

當 Middle Chinese Profile 建立完成後,

Engine 可以投射(Projection)到不同語言系統。

例如:

Middle Chinese
      │
      ├────► 漢越音
      │
      └────► 拼音

未來還可繼續擴充:

  • Kan-on(日本漢音)
  • Go-on(吳音)
  • Tō-on(唐音)
  • 韓國漢字音(Hanja Reading)
  • 各種漢語方言
  • 其他歷史重建系統

因此 Fanqie Engine 並非僅服務於漢越音,而是一個可共用的音韻平台。


每一個漢字都是一個知識節點

在 Ontology 中,

漢字不再只是 Unicode 字元。

它是一個 Node(節點)

例如:

                 Unicode
                    │
                    │
Meaning ──── 學 ─── Radical
                    │
                    │
         Middle Chinese
             ╱          ╲
            ╱            ╲
      漢越音             拼音
            ╲            ╱
             ╲          ╱
       Historical Sources

此節點可以同時連結:

  • Unicode
  • 部首
  • 字義
  • 反切
  • Middle Chinese
  • 漢越音
  • 拼音
  • 異體字
  • 各歷史讀音層
  • 韻書來源

每一條連結都具有明確的語言學意義。


透過演算法建立漢越音與拼音的關聯

Fanqie Engine 最重要的特點之一,就是:

並不直接儲存漢越音與拼音之間的對應。

它們之間的關係完全由演算法推導。

例如:

反切
 │
 ▼
Middle Chinese
 │
 ├────► Projection HV
 │
 └────► Projection PY

因此,

Engine 知道:

學
 │
 ├──► học
 │
 └──► xué

是由同一份 Middle Chinese Profile 推導而來。

而不是資料庫裡兩筆彼此獨立的紀錄。


Ontology 讓電腦真正理解資料

若只有字典,

電腦只知道:

國 → quốc

國 → guó

而在 Ontology 中,

電腦還知道:

  • 兩種讀音來自同一份 Middle Chinese Profile。
  • 它們具有相同歷史聲母。
  • 屬於相同韻部。
  • 擁有相同歷史聲調。
  • 差異僅來自不同語言各自的音變規律。

這些知識,是一般查詢表無法表示的。


不只是查詢工具

這樣的 Ontology 可支援許多應用。

依讀音搜尋

即使使用者只知道:

quốc

Engine 仍可找到:

並同時提供:

  • guó
  • Middle Chinese Profile
  • 歷史音韻資訊

多語言連結

同一漢字可同時連結:

  • 漢越音
  • 拼音
  • Kanji
  • Hanja
  • 各歷史讀音層

這對 Sino-Xenic(漢字文化圈借詞音)研究尤其重要。


發現音韻關係

Engine 不只知道兩個字是否同音,

還知道:

  • 是否同一聲母。
  • 是否同一韻部。
  • 是否因同一歷史來源而相似。
  • 或只是現代越南語中的偶然同音。

這些都是歷史語言研究的重要資訊。


Fanqie Engine 是 Quizzman 的基礎設施

從系統架構角度來看,

Fanqie Engine 並不是最終產品。

它是一層 Infrastructure Layer(基礎設施層)

Quizzman 其他產品,例如:

  • 漢越字典
  • 拼音查詢
  • 反切分析工具
  • 音韻研究平台
  • 語音搜尋系統
  • AI 漢字學習工具

皆可共用同一套由 Fanqie Engine 建立的 Ontology。

因此所有產品共享同一知識來源,而不需要維護多份彼此獨立的資料庫。


從推導工具走向知識平台

Quizzman Fanqie Engine 最初的目標,是根據反切推導漢越音。

隨著專案發展,它逐漸擴展成更大的方向:

建立一套以 Middle Chinese(中古漢語)為核心的語言 Ontology(本體)。

在這套模型中,

漢越音與拼音不再是兩筆人工對應的資料,

而是由同一份歷史音系推導出的不同結果。

正因如此,

Fanqie Engine 不只回答:

「這個字怎麼讀?」

更能回答:

「不同讀音系統之間為什麼彼此相關?」

這也是 Quizzman 的長期目標:

以 Fanqie Engine 為基礎,建立一套完整的 漢字 Ontology(漢字本體),讓每一個漢字都能與其歷史音韻、字義、韻書來源及東亞各語言讀音,共同組成一張統一且可推理的知識網路。