為什麼 Middle Chinese 的重建不是「猜測」?中古漢語重建背後的科學

Series 2 · 第 2 篇——中古漢語重建不是猜測 上一篇:Quizzman Fanqie Engine 的學術基礎:從《廣韻》到 Nguyễn Tài Cẩn

為什麼 Middle Chinese 的重建不是「猜測」?中古漢語重建背後的科學

提到 Middle Chinese(中古漢語) 時,最常見的誤解之一,就是認為語言學家只是在「猜測」一千多年前已經消失的語音。事實恰恰相反。中古漢語的重建,是一百多年來歷史語言學研究的成果,建立於反切、韻書、韻圖、漢越音、漢日音、漢韓音、現代漢語方言,以及現代音韻學等多種彼此獨立的證據之上。Quizzman Fanqie Engine 並沒有發明這套理論,而是將既有研究成果模型化,轉化成可計算、可驗證的演算法。

中古漢語已經沒有人使用了嗎?

答案是:

是的。

今天,

已經沒有任何社群仍然使用隋唐時期的中古漢語。

因此,

很多人自然會問:

既然沒有人會說,那又怎麼知道它當年的發音?

這是一個非常合理的問題。

許多歷史研究,

當見證者消失後,

往往只能依靠推測。

然而,

歷史語言學的情況不同。

中古漢語留下了大量珍貴文獻,

這些資料足以讓研究者以相當高的可信度,

重建整個音系。


反切,就是古人的「音標系統」

在 IPA 等現代音標出現之前,

中國古人便已發明了一套描述讀音的方法:

反切(反切)

例如:

德紅切

古人立刻知道:

  • 前一個字提供聲母;
  • 後一個字提供韻母與聲調。

換句話說,

反切本身就是一套描述發音的方法。

如果數萬個漢字都留下反切,

便可以建立整個音節之間的對應關係。

這正是中古漢語重建最重要的第一項基礎。


韻書保存了整個音系的結構

像:

  • 《切韻》
  • 《廣韻》
  • 《集韻》

這些韻書,

不只是收錄反切。

它們同時還將音節分類為:

  • 聲母;
  • 韻;
  • 攝;
  • 等;
  • 開口;
  • 合口;
  • 聲調。

某種程度上,

古人無意間留下了一套完整的語音資料庫。

例如:

如果兩個字屬於同一韻,

便表示它們在韻母上極為接近。

如果兩個字屬於同一聲母,

便表示它們具有相近的聲母。

透過這些彼此交織的關係,

整個音系便能逐步重建。


重建並非只依賴單一資料來源

如果只依靠《廣韻》,

證據仍然不足。

真正重要的是:

不同來源彼此互相驗證。

例如,

同一個音節,

可以同時透過:

  • 反切;
  • 韻圖;
  • 漢越音;
  • 漢日音;
  • 漢韓音;
  • 粵語;
  • 閩南語;

等資料進行比對。

當所有來源都指向相同方向時,

結論的可信度便大幅提高。

這正是歷史語言學中的:

獨立證據交叉驗證(Independent Corroboration)


漢越音是一種「語言化石」

中古漢語重建最重要的資料之一,

就是漢越音。

乍看之下,

這似乎令人意外。

為什麼越南語,

能幫助重建中古漢語?

答案就在歷史。

大部分標準漢越音,

形成於西元八、九世紀左右,

正值唐代漢語仍然存在。

因此,

漢越音保留下大量中古漢語的重要特徵。

例如:

quốc

仍然保存:

-k

而現代普通話:

guó

早已失去這個入聲韻尾。

像這樣的歷史痕跡,

便成為檢驗重建模型的重要依據。


漢日音與漢韓音,也提供了相同證據

不只有越南語。

日本與韓國,

也在不同歷史時期接受漢字。

例如:

quốc

こく

三種不同語言。

三套不同讀音。

卻都來自相同的歷史來源。

當它們放在一起比較時,

便能拼湊出中古漢語原本的樣貌。

因此,

歷史語言學家稱它們為:

Sino-Xenic Readings(漢字借詞讀音)


現代方言仍保留許多中古特徵

另一個常見誤解是:

普通話代表整個漢語。

事實並非如此。

普通話,

只是漢語眾多分支之一。

不少現代方言,

仍然保存大量中古特徵。

例如:

粵語仍然保留完整的入聲系統。

部分閩南語方言,

仍保存中古時期的重要聲母對立。

因此,

將:

  • 現代方言;
  • 反切;
  • 漢越音;
  • 漢日音;
  • 漢韓音;

放在一起分析,

便能判斷:

哪些特徵屬於古層,

哪些則是後來才產生的演變。


Reconstruction 並不是唯一答案

這一點非常重要。

目前世界上,

存在多套中古漢語重建系統。

例如:

  • Karlgren
  • Li Fang-Kuei
  • Pulleyblank
  • Zhengzhang
  • Baxter
  • Baxter–Sagart

它們彼此並不完全相同。

原因在於:

每一套模型,

都有不同研究目標。

有些重視:

  • 語音。

有些重視:

  • 形態。

有些重視:

  • 歷史演變。

因此,

並不存在唯一絕對正確的 Reconstruction。

科學允許不同模型並存,

只要它們都能合理解釋現有證據。


Quizzman Fanqie Engine 如何使用 Reconstruction?

Quizzman Fanqie Engine

並沒有試圖建立一套全新的中古漢語重建系統。

Engine 也沒有宣稱,

某一套模型絕對正確。

相反地,

Engine 採用了:

Baxter-like Reconstruction

並結合:

zyenpheng Database

作為實作基礎。

Middle Chinese Reconstruction 的目標是:

  • 建立一致性的 Middle Chinese Profile;
  • 提供足夠細緻的資訊供漢越音 Projection 使用;
  • 同時支援 Pinyin 與其他 Reading System 的推導。

換句話說,

Middle Chinese 並不是最終目標。

它只是:

整個架構中的中介層(Intermediate Representation)。


科學模型可以持續更新

採用學術模型,

還有一個重要優點。

沒有任何規則會被永久固定。

如果未來出現:

  • 新的反切材料;
  • 新的研究成果;
  • 更完善的 Reconstruction;

Engine 便能更新規則,

而不需要重新設計整個架構。

因此,

Quizzman Fanqie Engine 並不把 Reconstruction 視為不可動搖的真理。

它只是:

目前證據下最合理的模型。


從學術研究走向演算法

Quizzman Fanqie Engine 最大的特色,

並不只是引用 Karlgren、Baxter 或 Nguyễn Tài Cẩn 等學者的研究。

真正重要的是:

這些研究成果,

被轉化為:

可以計算、

可以測試、

可以重複利用的演算法。

因此,

Engine 不需要每次分析反切時,

重新閱讀數千頁學術著作。

它可以在極短時間內,

完成整個推導流程,

同時保留完整的可解釋性。

這也是 Quizzman 的核心目標:

並非取代語言學家的研究,

而是將經過驗證的學術成果,

模型化為一套可計算的系統,

服務於歷史語言研究、教育,以及未來各種自然語言處理應用。