Series 2 · 第 2 篇——中古汉语重建不是猜测 上一篇:Quizzman Fanqie Engine 的学术基础:从《广韵》到 Nguyễn Tài Cẩn
为什么 Middle Chinese 的重建不是「猜测」?中古汉语重建背后的科学
提到 Middle Chinese(中古汉语) 时,最常见的误解之一,就是认为语言学家只是在「猜测」一千多年前已经消失的语音。事实恰恰相反。中古汉语的重建,是一百多年来历史语言学研究的成果,建立于反切、韵书、韵图、汉越音、汉日音、汉韩音、现代汉语方言,以及现代音韵学等多种彼此独立的证据之上。Quizzman Fanqie Engine 并没有发明这套理论,而是将既有研究成果模型化,转化成可计算、可验证的演算法。
中古汉语已经没有人使用了吗?
答案是:
是的。
今天,
已经没有任何社群仍然使用隋唐时期的中古汉语。
因此,
很多人自然会问:
既然没有人会说,那又怎么知道它当年的发音?
这是一个非常合理的问题。
许多历史研究,
当见证者消失后,
往往只能依靠推测。
然而,
历史语言学的情况不同。
中古汉语留下了大量珍贵文献,
这些资料足以让研究者以相当高的可信度,
重建整个音系。
反切,就是古人的「音标系统」
在 IPA 等现代音标出现之前,
中国古人便已发明了一套描述读音的方法:
反切(反切)
例如:
德红切
古人立刻知道:
- 前一个字提供声母;
- 后一个字提供韵母与声调。
换句话说,
反切本身就是一套描述发音的方法。
如果数万个汉字都留下反切,
便可以建立整个音节之间的对应关系。
这正是中古汉语重建最重要的第一项基础。
韵书保存了整个音系的结构
像:
- 《切韵》
- 《广韵》
- 《集韵》
这些韵书,
不只是收录反切。
它们同时还将音节分类为:
- 声母;
- 韵;
- 摄;
- 等;
- 开口;
- 合口;
- 声调。
某种程度上,
古人无意间留下了一套完整的语音资料库。
例如:
如果两个字属于同一韵,
便表示它们在韵母上极为接近。
如果两个字属于同一声母,
便表示它们具有相近的声母。
透过这些彼此交织的关系,
整个音系便能逐步重建。
重建并非只依赖单一资料来源
如果只依靠《广韵》,
证据仍然不足。
真正重要的是:
不同来源彼此互相验证。
例如,
同一个音节,
可以同时透过:
- 反切;
- 韵图;
- 汉越音;
- 汉日音;
- 汉韩音;
- 粤语;
- 闽南语;
等资料进行比对。
当所有来源都指向相同方向时,
结论的可信度便大幅提高。
这正是历史语言学中的:
独立证据交叉验证(Independent Corroboration)
汉越音是一种「语言化石」
中古汉语重建最重要的资料之一,
就是汉越音。
乍看之下,
这似乎令人意外。
为什么越南语,
能帮助重建中古汉语?
答案就在历史。
大部分标准汉越音,
形成于西元八、九世纪左右,
正值唐代汉语仍然存在。
因此,
汉越音保留下大量中古汉语的重要特征。
例如:
国
↓
quốc
仍然保存:
-k
而现代普通话:
guó
早已失去这个入声韵尾。
像这样的历史痕迹,
便成为检验重建模型的重要依据。
汉日音与汉韩音,也提供了相同证据
不只有越南语。
日本与韩国,
也在不同历史时期接受汉字。
例如:
国
↓
quốc
↓
こく
↓
국
三种不同语言。
三套不同读音。
却都来自相同的历史来源。
当它们放在一起比较时,
便能拼凑出中古汉语原本的样貌。
因此,
历史语言学家称它们为:
Sino-Xenic Readings(汉字借词读音)
现代方言仍保留许多中古特征
另一个常见误解是:
普通话代表整个汉语。
事实并非如此。
普通话,
只是汉语众多分支之一。
不少现代方言,
仍然保存大量中古特征。
例如:
粤语仍然保留完整的入声系统。
部分闽南语方言,
仍保存中古时期的重要声母对立。
因此,
将:
- 现代方言;
- 反切;
- 汉越音;
- 汉日音;
- 汉韩音;
放在一起分析,
便能判断:
哪些特征属于古层,
哪些则是后来才产生的演变。
Reconstruction 并不是唯一答案
这一点非常重要。
目前世界上,
存在多套中古汉语重建系统。
例如:
- Karlgren
- Li Fang-Kuei
- Pulleyblank
- Zhengzhang
- Baxter
- Baxter–Sagart
它们彼此并不完全相同。
原因在于:
每一套模型,
都有不同研究目标。
有些重视:
- 语音。
有些重视:
- 形态。
有些重视:
- 历史演变。
因此,
并不存在唯一绝对正确的 Reconstruction。
科学允许不同模型并存,
只要它们都能合理解释现有证据。
Quizzman Fanqie Engine 如何使用 Reconstruction?
Quizzman Fanqie Engine
并没有试图建立一套全新的中古汉语重建系统。
Engine 也没有宣称,
某一套模型绝对正确。
相反地,
Engine 采用了:
Baxter-like Reconstruction
并结合:
zyenpheng Database
作为实作基础。
Middle Chinese Reconstruction 的目标是:
- 建立一致性的 Middle Chinese Profile;
- 提供足够细致的资讯供汉越音 Projection 使用;
- 同时支援 Pinyin 与其他 Reading System 的推导。
换句话说,
Middle Chinese 并不是最终目标。
它只是:
整个架构中的中介层(Intermediate Representation)。
科学模型可以持续更新
采用学术模型,
还有一个重要优点。
没有任何规则会被永久固定。
如果未来出现:
- 新的反切材料;
- 新的研究成果;
- 更完善的 Reconstruction;
Engine 便能更新规则,
而不需要重新设计整个架构。
因此,
Quizzman Fanqie Engine 并不把 Reconstruction 视为不可动摇的真理。
它只是:
目前证据下最合理的模型。
从学术研究走向演算法
Quizzman Fanqie Engine 最大的特色,
并不只是引用 Karlgren、Baxter 或 Nguyễn Tài Cẩn 等学者的研究。
真正重要的是:
这些研究成果,
被转化为:
可以计算、
可以测试、
可以重复利用的演算法。
因此,
Engine 不需要每次分析反切时,
重新阅读数千页学术著作。
它可以在极短时间内,
完成整个推导流程,
同时保留完整的可解释性。
这也是 Quizzman 的核心目标:
并非取代语言学家的研究,
而是将经过验证的学术成果,
模型化为一套可计算的系统,
服务于历史语言研究、教育,以及未来各种自然语言处理应用。