是的,但是……ChatGPT 能识别历史文档中的实体吗?
数字图书馆
2023-03-31 v1 计算与语言
信息检索
摘要
大型语言模型(LLMs)已被利用数年,在从现代文档中识别实体方面取得了最先进的性能。过去几个月中,对话智能体 ChatGPT 因其生成听起来合理的回答的能力,在科学界和公众中“引发”了大量关注。在本文中,我们以零样本方式在历史 primary sources(如历史报纸和古典评注)的命名实体识别与分类(NERC)任务中探测了这一能力,并将其与基于最先进 LM 的系统进行比较。我们的发现指出了在历史文本识别实体方面的若干不足,范围涉及实体标注指南的一致性、实体复杂性、语码转换,以及提示的特异性。此外,正如预期,历史档案对公众(进而对互联网)的不可访问性也影响了其性能。
引用
@article{arxiv.2303.17322,
title = {Yes but.. Can ChatGPT Identify Entities in Historical Documents?},
author = {Carlos-Emiliano González-Gallardo and Emanuela Boros and Nancy Girdhar and Ahmed Hamdi and Jose G. Moreno and Antoine Doucet},
journal= {arXiv preprint arXiv:2303.17322},
year = {2023}
}
备注
5 pages, accepted to JCDL2023