Google DeepMind Aeneas:用于古代铭文情境化的 AI

Google DeepMind 推出了 Aeneas,这是一种多模态生成神经网络,旨在帮助历史学家解释、归属和修复零碎的拉丁铭文。通过自动识别文本和情境的相似之处,Aeneas 加速了对常常风化或受损的古代文本进行年代测定和定位的过程。

史铭学分析的高级能力

相较于之前的模型(包括其前身 Ithaca——专注于古希腊铭文),Aeneas 提供了多项关键技术进步。其主要功能包括:

  • 相似搜索: 模型为每段文本创建“历史指纹”(嵌入),以识别跨大量拉丁铭文的深层关联,使历史学家能够将碎片置于更广阔的情境中。
  • 多模态来源判定: Aeneas 是首个通过分析文本数据和视觉信息(如铭文图像)来确定地理来源的模型。
  • 灵活的文本修复: 模型能够在缺失长度未知的情况下填补文本空缺,这对处理严重损毁的材料是重大改进。
  • 领先的性能表现: Aeneas 为预测铭文的年代、地点以及修复受损文本设立了新的基准。

技术架构与训练

Aeneas 是一种多模态生成神经网络,使用基于 Transformer 的解码器处理文本和图像输入。

数据来源与拉丁铭文数据集(LED)

为了训练模型,研究人员整理了拉丁铭文数据集(LED),该数据集整合了来自三个主要数字收藏的超过 176,000 条拉丁铭文:

  1. 拉丁铭文数据库 Roma(EDR)
  2. 拉丁铭文数据库 Heidelberg(EDH)
  3. 拉丁铭文数据库 Clauss Slaby(EDCS-ELT)

模型机制

模型利用专门的网络基于文本进行字符修复和年代预测,同时地理归属则结合图像数据。情境化机制使用嵌入来编码语言、内容、来源以及铭文之间的关系,使解码器能够从 LED 中检索并排序相似的相似文本。

性能基准与验证

相较于通用拉丁语言模型(LLM),Aeneas 在年代分组方面表现出色。关键指标包括:

  • 修复准确率: 对于最多十字符的缺口,Top-20 准确率为 73%;在缺失长度未知的情况下,准确率为 58%。
  • 地理归属: 使用视觉数据将铭文归属至 62 个古罗马省份之一的准确率为 72%。
  • 年代精度: 模型通常能将文本定位在历史学家提供的时间范围内 ±13 年。
  • 可解释性: 模型提供显著性图,突出显示哪些具体输入影响了其预测。

在历史争论中的应用:Res Gestae

为了在真实的研究争论中检验模型,Aeneas 被应用于《Res Gestae Divi Augusti》(奥古斯都皇帝的功绩记述)。Aeneas 并未给出单一日期,而是生成了一个包含两个峰值的概率分布:一个较小的峰值位于公元前 10–1 年左右,另一个较大的峰值位于公元 10–20 年之间。这一量化方法捕捉了基于文本中细微语言特征和官方头衔的主流学术假设。

合作影响与可及性

在一项涉及 23 位历史学家的研究中,当专家将 Aeneas 的情境相似项与其修复和归属预测结合使用时,取得了最有效的成果。历史学家们报告称,该工具加快了他们的工作,并帮助发现了改变他们对特定铭文认知的新相似点。

可用性与教育整合

Google DeepMind 通过以下渠道提供 Aeneas:

  • 交互式工具: 可在 predictingthepast.com 免费获取。
  • 开源: 代码和数据集已在 GitHub 上提供。
  • Ithaca 升级: 古希腊模型 Ithaca 已升级为由 Aeneas 驱动,加入了情境化功能和改进的修复能力。
  • 教育: 已共同设计了一套新的教学大纲,以桥接技术 AI 技能与历史思维,符合欧盟委员会、联合国教科文组织和经合组织的框架。

Sources