從 Middle Chinese 到拼音與漢越音:為什麼 Quizzman Fanqie Engine 能從同一份資料生成多種讀音系統?

Quizzman Fanqie Engine 系列 — 第 12 篇。上一篇:開發歷程 · V6

從 Middle Chinese 到拼音與漢越音:為什麼 Quizzman Fanqie Engine 能從同一份資料生成多種讀音系統?

現今大多數工具都只針對單一目標而設計。漢越音工具只能生成漢越音,拼音工具只能生成拼音,因此每套系統都必須維護自己的規則與資料庫,也難以擴展到其他語言。Quizzman Fanqie Engine 採用了完全不同的架構。它並不把漢越音或拼音視為起點,而是將 Middle Chinese(中古漢語) 作為整個系統最重要的中介層。從同一份 Middle Chinese 音韻資料出發,Engine 可以推導出不同的讀音系統。因此,Quizzman Fanqie Engine 不只是漢越音引擎,更是一個歷史音韻計算平台。

一個漢字不只有一種讀音

對多數學習中文或漢越音的人而言,一個漢字通常只有一種讀法。

例如:

| 漢字 | 漢越音 | 拼音 | |------|---------|-------| | 國 | quốc | guó | | 學 | học | xué | | 德 | đức | dé |

因此,很多人認為:

漢越音與拼音是兩套彼此獨立的系統。

事實並非如此。

兩者其實都源自同一個共同祖先

那就是 Middle Chinese(中古漢語)


Middle Chinese 才是核心

在 Quizzman Fanqie Engine 的架構中,不存在:

漢字
 ↓
漢越音

也不存在:

漢字
 ↓
拼音

所有流程都必須經過同一層中介。

漢字
 ↓
反切
 ↓
Middle Chinese
 ↓
現代讀音系統

這表示:

漢越音與拼音並不是彼此獨立生成。

它們都是由同一份 Middle Chinese 音韻資料推導而來。


Middle Chinese 音韻資料包含哪些內容?

完成反切分析之後,Engine 會建立一份完整的音韻資料。

例如:

| 項目 | 值 | |------|----| | 聲母 | 幫 | | 韻 | 東 | | 攝 | 通 | | 等 | 一等 | | 開合 | 開口 | | 聲調 | 平聲 |

這就是一個音節的「DNA」。

生成不同讀音系統所需的全部資訊,都已經包含在這份資料之中。


為什麼要這樣設計?

假設沒有 Middle Chinese 這一層。

Engine 就必須分別建立:

  • 漢越音規則
  • 拼音規則

兩套系統幾乎無法共享任何內容。

如果日後想新增:

  • 漢音(Kan-on)
  • 吳音(Go-on)
  • 韓漢音
  • 或其他漢語方言

幾乎所有工作都必須重新開始。

這樣的架構非常難以擴充。


一個中介層,對應多種輸出

Quizzman Fanqie Engine 的解決方式,就是讓 Middle Chinese 成為整個系統的核心。

                Middle Chinese
               /      |       \
              /       |        \
             ▼        ▼         ▼

         漢越音     拼音      其他讀音系統

因此,所有讀音系統都共享同一份歷史音韻資料。

只要 Middle Chinese 的分析更加完善,

所有讀音系統都能同步受益。


生成漢越音

生成漢越音時,Engine 會依序套用:

  • 聲母規則
  • 韻母規則
  • 十六攝規則
  • 開口規則
  • 合口規則
  • Eight Tone Slot
  • Lexical Normalization

最後得到漢越音。

例如:

Middle Chinese
        ↓
     quốc

生成拼音

對於現代普通話,

Engine 不會使用漢越音規則。

而是套用普通話歷史演變規律,例如:

  • 聲母歷史演變
  • 入聲消失
  • 多個韻部合流
  • 聲調的不同演化

因此得到:

Middle Chinese
        ↓
      guó

雖然結果不同,

但漢越音與拼音都源自同一份 Middle Chinese 音韻資料。


兩種語言,兩條演化路徑

有趣的是:

漢越音與拼音並不是彼此翻譯。

它們是同一祖先演化出的兩條不同分支。

            Middle Chinese
                 │
      ┌──────────┴──────────┐
      ▼                     ▼
    漢越音               現代普通話
      │                     │
    quốc                 guó

不存在:

quốc
 ↓
guó

或:

guó
 ↓
quốc

兩者都是獨立地從 Middle Chinese 演變而來。


為什麼漢越音保留了更多古代特徵?

有趣的是,

許多情況下,

漢越音仍保留了普通話早已消失的歷史特徵。

例如:

法
 ↓
pháp

仍保留:

-p

但普通話:

已完全失去塞音韻尾。

同樣的情況也出現在:

  • 德 → đức
  • 國 → quốc
  • 學 → học

因此,

漢越音在歷史語言研究中具有極高價值。


不只是漢越音與拼音

有了 Middle Chinese 這一層之後,

要擴充新的讀音系統就容易得多。

理論上,同一份音韻資料還可以生成:

Middle Chinese
        ↓
      漢音(Kan-on)

Middle Chinese
        ↓
      吳音(Go-on)

Middle Chinese
        ↓
      韓漢音

Middle Chinese
        ↓
      各種漢語方言

每一種讀音系統,

只需要建立自己的 Projection 規則即可。

整個 Engine 不需要重新設計。


面向平台的架構

這也是 Quizzman Fanqie Engine 並非單一應用程式的原因。

它被設計成一個 Phonological Platform

Middle Chinese 扮演的是一種「中介語言」。

各種讀音系統,

只是建立在這個中介層上的不同 Projection。

這樣的設計可以:

  • 減少規則重複
  • 更容易測試
  • 更容易擴充
  • 更容易維護
  • 更容易進行學術研究

不只是查詢工具

當 Middle Chinese 成為核心資料之後,

Engine 的用途便遠遠超越查詢工具。

同一份音韻資料還可以應用於:

  • 音韻學研究
  • 反切分析
  • 歷史字典建構
  • 漢文文本處理
  • NLP
  • AI
  • OCR
  • 古音重建

因此,

Quizzman Fanqie Engine 被定位為一個歷史音韻計算平台

而不只是漢越音查詢工具。


為未來而設計的架構

這套架構最大的優勢,

並不在於目前支援多少種讀音系統。

真正的優勢在於它的可擴充性。

當需要新增新的讀音系統時,

開發團隊不必重寫整個 Engine。

只需要建立新的 Projection Layer,

即可從同一份 Middle Chinese 音韻資料推導新的結果。

這也是 Quizzman Fanqie Engine 始終堅持的核心理念:

一份 Middle Chinese 音韻資料,多種讀音系統(One Middle Chinese Profile, Multiple Reading Systems)。

正因如此,Quizzman Fanqie Engine 得以持續演進,逐步成為服務於東亞歷史語言研究的計算平台,而不僅僅停留在漢越音或拼音生成工具。