中文

甲骨文 inscribed 多模态数据集

计算机视觉与模式识别 2024-07-08 v1

摘要

甲骨文 inscribed(OBI)是中国最早发展的书写系统,承载着珍贵的早期商代历史和考古学的书面范例。然而,在当前学术氛围下解读OBI任务则极其具有挑战性。在4,500件甲骨文字符挖掘出的 only 1/3 被成功识别。因此,利用先进AI技术辅助OBI解读已成为高度必要的研究主题。然而,充分发挥AI在这些事务中的能力依赖于手头拥有全面且高质量的OBI数据集,而大多数现有数据集仅在单一或少数维度上进行注释,限制了其潜在应用价值。例如,Oracle-MNIST数据集仅提供30k张图像,分类为10个类别。因此,本文提出了一个甲骨文 inscribed 多模态数据集(OBIMD),其中包括10,077件甲骨文的注释信息。每件作品包含两种模态:像素级对齐的压版和原件。该数据集对每件甲骨文字符进行检测框、字符类别、转写、相应的铭文组以及每个甲骨文字符的阅读序列进行注释,提供了全面且高质量的注释水平。该数据集可用于与OBI相关的各种AI研究任务,如OBI字符检测与识别、压版去噪、字符匹配、字符生成、阅读序列预测、缺失字符完成等。我们认为,创建和发布此类数据集将显著推动AI算法在OBI研究领域的应用。

关键词

引用

@article{arxiv.2407.03900,
  title  = {Oracle Bone Inscriptions Multi-modal Dataset},
  author = {Bang Li and Donghao Luo and Yujie Liang and Jing Yang and Zengmao Ding and Xu Peng and Boyuan Jiang and Shengwei Han and Dan Sui and Peichao Qin and Pian Wu and Chaoyang Wang and Yun Qi and Taisong Jin and Chengjie Wang and Xiaoming Huang and Zhan Shu and Rongrong Ji and Yongge Liu and Yunsheng Wu},
  journal= {arXiv preprint arXiv:2407.03900},
  year   = {2024}
}