中文

语言模型反映了谁的观点?

计算与语言 2023-03-31 v1 人工智能 计算机与社会 机器学习

摘要

语言模型(LM)正日益被用于开放式语境中,LM 在回应主观查询时所反映的观点可能产生深远影响,既影响用户满意度,也塑造社会整体的看法。在本工作中,我们提出一个定量框架来研究 LM 所反映的观点——通过利用高质量的民意调查及其相关人类回应。利用该框架,我们创建了 OpinionsQA,一个用于评估 LM 观点与 60 个美国人口统计群体在从堕胎到自动化等话题上一致性的新数据集。在各话题上,我们发现当前 LM 所反映的观点与美国人统计群体观点之间存在显著不一致:其程度与气候变化议题上的民主党-共和党分歧相当。值得注意的是,即使在显式地将 LM 导向特定人口统计群体后,这种不一致仍然存在。我们的分析不仅证实了先前关于某些人类反馈微调 LM 左倾倾向的观察,也揭示了一些其观点未被当前 LM 充分反映的群体(例如 65 岁以上及丧偶个体)。我们的代码与数据可在 https://github.com/tatsu-lab/opinions_qa 获取。

关键词

引用

@article{arxiv.2303.17548,
  title  = {Whose Opinions Do Language Models Reflect?},
  author = {Shibani Santurkar and Esin Durmus and Faisal Ladhak and Cinoo Lee and Percy Liang and Tatsunori Hashimoto},
  journal= {arXiv preprint arXiv:2303.17548},
  year   = {2023}
}