为什么 Middle Chinese 的重建不是「猜测」?中古汉语重建背后的科学

Series 2 · 第 2 篇——中古汉语重建不是猜测 上一篇:Quizzman Fanqie Engine 的学术基础:从《广韵》到 Nguyễn Tài Cẩn

为什么 Middle Chinese 的重建不是「猜测」?中古汉语重建背后的科学

提到 Middle Chinese(中古汉语) 时,最常见的误解之一,就是认为语言学家只是在「猜测」一千多年前已经消失的语音。事实恰恰相反。中古汉语的重建,是一百多年来历史语言学研究的成果,建立于反切、韵书、韵图、汉越音、汉日音、汉韩音、现代汉语方言,以及现代音韵学等多种彼此独立的证据之上。Quizzman Fanqie Engine 并没有发明这套理论,而是将既有研究成果模型化,转化成可计算、可验证的演算法。

中古汉语已经没有人使用了吗?

答案是:

是的。

今天,

已经没有任何社群仍然使用隋唐时期的中古汉语。

因此,

很多人自然会问:

既然没有人会说,那又怎么知道它当年的发音?

这是一个非常合理的问题。

许多历史研究,

当见证者消失后,

往往只能依靠推测。

然而,

历史语言学的情况不同。

中古汉语留下了大量珍贵文献,

这些资料足以让研究者以相当高的可信度,

重建整个音系。


反切,就是古人的「音标系统」

在 IPA 等现代音标出现之前,

中国古人便已发明了一套描述读音的方法:

反切(反切)

例如:

德红切

古人立刻知道:

  • 前一个字提供声母;
  • 后一个字提供韵母与声调。

换句话说,

反切本身就是一套描述发音的方法。

如果数万个汉字都留下反切,

便可以建立整个音节之间的对应关系。

这正是中古汉语重建最重要的第一项基础。


韵书保存了整个音系的结构

像:

  • 《切韵》
  • 《广韵》
  • 《集韵》

这些韵书,

不只是收录反切。

它们同时还将音节分类为:

  • 声母;
  • 韵;
  • 摄;
  • 等;
  • 开口;
  • 合口;
  • 声调。

某种程度上,

古人无意间留下了一套完整的语音资料库。

例如:

如果两个字属于同一韵,

便表示它们在韵母上极为接近。

如果两个字属于同一声母,

便表示它们具有相近的声母。

透过这些彼此交织的关系,

整个音系便能逐步重建。


重建并非只依赖单一资料来源

如果只依靠《广韵》,

证据仍然不足。

真正重要的是:

不同来源彼此互相验证。

例如,

同一个音节,

可以同时透过:

  • 反切;
  • 韵图;
  • 汉越音;
  • 汉日音;
  • 汉韩音;
  • 粤语;
  • 闽南语;

等资料进行比对。

当所有来源都指向相同方向时,

结论的可信度便大幅提高。

这正是历史语言学中的:

独立证据交叉验证(Independent Corroboration)


汉越音是一种「语言化石」

中古汉语重建最重要的资料之一,

就是汉越音。

乍看之下,

这似乎令人意外。

为什么越南语,

能帮助重建中古汉语?

答案就在历史。

大部分标准汉越音,

形成于西元八、九世纪左右,

正值唐代汉语仍然存在。

因此,

汉越音保留下大量中古汉语的重要特征。

例如:

quốc

仍然保存:

-k

而现代普通话:

guó

早已失去这个入声韵尾。

像这样的历史痕迹,

便成为检验重建模型的重要依据。


汉日音与汉韩音,也提供了相同证据

不只有越南语。

日本与韩国,

也在不同历史时期接受汉字。

例如:

quốc

こく

三种不同语言。

三套不同读音。

却都来自相同的历史来源。

当它们放在一起比较时,

便能拼凑出中古汉语原本的样貌。

因此,

历史语言学家称它们为:

Sino-Xenic Readings(汉字借词读音)


现代方言仍保留许多中古特征

另一个常见误解是:

普通话代表整个汉语。

事实并非如此。

普通话,

只是汉语众多分支之一。

不少现代方言,

仍然保存大量中古特征。

例如:

粤语仍然保留完整的入声系统。

部分闽南语方言,

仍保存中古时期的重要声母对立。

因此,

将:

  • 现代方言;
  • 反切;
  • 汉越音;
  • 汉日音;
  • 汉韩音;

放在一起分析,

便能判断:

哪些特征属于古层,

哪些则是后来才产生的演变。


Reconstruction 并不是唯一答案

这一点非常重要。

目前世界上,

存在多套中古汉语重建系统。

例如:

  • Karlgren
  • Li Fang-Kuei
  • Pulleyblank
  • Zhengzhang
  • Baxter
  • Baxter–Sagart

它们彼此并不完全相同。

原因在于:

每一套模型,

都有不同研究目标。

有些重视:

  • 语音。

有些重视:

  • 形态。

有些重视:

  • 历史演变。

因此,

并不存在唯一绝对正确的 Reconstruction。

科学允许不同模型并存,

只要它们都能合理解释现有证据。


Quizzman Fanqie Engine 如何使用 Reconstruction?

Quizzman Fanqie Engine

并没有试图建立一套全新的中古汉语重建系统。

Engine 也没有宣称,

某一套模型绝对正确。

相反地,

Engine 采用了:

Baxter-like Reconstruction

并结合:

zyenpheng Database

作为实作基础。

Middle Chinese Reconstruction 的目标是:

  • 建立一致性的 Middle Chinese Profile;
  • 提供足够细致的资讯供汉越音 Projection 使用;
  • 同时支援 Pinyin 与其他 Reading System 的推导。

换句话说,

Middle Chinese 并不是最终目标。

它只是:

整个架构中的中介层(Intermediate Representation)。


科学模型可以持续更新

采用学术模型,

还有一个重要优点。

没有任何规则会被永久固定。

如果未来出现:

  • 新的反切材料;
  • 新的研究成果;
  • 更完善的 Reconstruction;

Engine 便能更新规则,

而不需要重新设计整个架构。

因此,

Quizzman Fanqie Engine 并不把 Reconstruction 视为不可动摇的真理。

它只是:

目前证据下最合理的模型。


从学术研究走向演算法

Quizzman Fanqie Engine 最大的特色,

并不只是引用 Karlgren、Baxter 或 Nguyễn Tài Cẩn 等学者的研究。

真正重要的是:

这些研究成果,

被转化为:

可以计算、

可以测试、

可以重复利用的演算法。

因此,

Engine 不需要每次分析反切时,

重新阅读数千页学术著作。

它可以在极短时间内,

完成整个推导流程,

同时保留完整的可解释性。

这也是 Quizzman 的核心目标:

并非取代语言学家的研究,

而是将经过验证的学术成果,

模型化为一套可计算的系统,

服务于历史语言研究、教育,以及未来各种自然语言处理应用。