中文

WenyanGPT:面向古文任务的大型语言模型

计算与语言 2025-04-30 v1

摘要

古文作为中华文化核心载体,在继承与研究古典文学方面发挥着关键作用。然而,现有自然语言处理模型主要针对现代汉语优化,古文性能不足。本文提出了完整的古文语言处理解决方案。通过在 LLaMA3-8B-Chinese 模型基础上持续预训练和指令微调,我们构建了一个专为古文任务设计的大型语言模型,命名为 WenyanGPT。此外,我们开发了评估基准数据集 WenyanBENCH。在 WenyanBENCH 上的实验结果表明,WenyanGPT 在各种古文任务上显著优于当前先进的大型语言模型。我们公开模型训练数据、指令微调数据\footnote、以及评估基准数据集,以推动古文处理领域的进一步研究与发展。

关键词

引用

@article{arxiv.2504.20609,
  title  = {WenyanGPT: A Large Language Model for Classical Chinese Tasks},
  author = {Xinyu Yao and Mengdi Wang and Bo Chen and Xiaobing Zhao},
  journal= {arXiv preprint arXiv:2504.20609},
  year   = {2025}
}