中文

JETHICS:日语伦理理解评估数据集

计算与语言 2025-06-23 v1 人工智能

摘要

在这项工作中,我们提出了JETHICS,一个用于评估AI模型伦理理解的日语数据集。JETHICS包含78K个样本,并遵循现有英文ETHICS数据集的构建方法构建。它包含基于伦理学和政治哲学规范理论的四个类别,以及一个代表常识道德的类别。我们对非专有大语言模型(LLM)和GPT-4o的评估实验显示,即使是GPT-4o也仅达到约0.7的平均得分,而表现最佳的日语LLM得分约为0.5,表明当前LLM仍有相当大的改进空间。

关键词

引用

@article{arxiv.2506.16187,
  title  = {JETHICS: Japanese Ethics Understanding Evaluation Dataset},
  author = {Masashi Takeshita and Rafal Rzepka},
  journal= {arXiv preprint arXiv:2506.16187},
  year   = {2025}
}