中文

迈向大型语言模型中“文化”的测量与建模:一项综述

计算机与社会 2024-09-05 v5 人工智能 计算与语言

摘要

我们综述了 90 多篇近期旨在研究大型语言模型中文化表征与包容性的论文。我们观察到,没有一项研究明确定义“文化”这一复杂、多层面的概念;相反,它们在一些专门设计的数据集上探测模型,这些数据集代表了“文化”的某些方面。我们将这些方面称为文化的代理,并沿着人口统计学代理和语义代理两个维度对其进行组织。我们还对所采用的探测方法进行了分类。我们的分析表明,只有文化的某些方面(如价值观和目标)得到了研究,而其他几个有趣且重要的层面,特别是众多的语义域和关于性,尚未被探索。另外两个关键的缺口是探测技术缺乏稳健性,以及缺乏关于基于 LLM 的应用中文化误表征和表征不足影响的实地研究。

关键词

引用

@article{arxiv.2403.15412,
  title  = {Towards Measuring and Modeling "Culture" in LLMs: A Survey},
  author = {Muhammad Farid Adilazuarda and Sagnik Mukherjee and Pradhyumna Lavania and Siddhant Singh and Alham Fikri Aji and Jacki O'Neill and Ashutosh Modi and Monojit Choudhury},
  journal= {arXiv preprint arXiv:2403.15412},
  year   = {2024}
}