中文

大型语言模型是变色龙吗?模拟社会调查的一次尝试

计算与语言 2024-10-22 v2 人工智能 计算机与社会 机器学习

摘要

大型语言模型能否模拟社会调查?为了回答这个问题,我们进行了数百万次模拟,要求LLMs回答主观问题。将不同LLM的回答与欧洲社会调查数据进行比较表明,提示对偏差和变异性的影响是根本性的,突显了主要的文化、年龄和性别偏见。我们进一步讨论了用于衡量LLM答案与调查数据之间差异的统计方法,并提出了一种受杰卡德相似性启发的新度量,因为LLM生成的响应可能具有较小的方差。我们的实验还揭示,在使用LLMs模拟社会调查之前,分析提示的鲁棒性和变异性非常重要,因为它们的模仿能力最多只是近似的。

关键词

引用

@article{arxiv.2405.19323,
  title  = {Are Large Language Models Chameleons? An Attempt to Simulate Social Surveys},
  author = {Mingmeng Geng and Sihong He and Roberto Trotta},
  journal= {arXiv preprint arXiv:2405.19323},
  year   = {2024}
}

备注

17 pages