中文

作为文化视角叠加态的大语言模型

计算与语言 2023-11-08 v3 人工智能 机器学习

摘要

大语言模型(LLMs)常被误导性地认为具有某种人格或一组价值观。我们认为,LLM 可被视为具有不同价值观与人格特质的视角的叠加态。LLM 展现出依赖于语境的价值观与人格特质,这些特质会随所诱导的视角而变化(与之相反,人类在不同语境下往往具有更一致的价值观与人格特质)。我们引入视角可控性(perspective controllability)这一概念,指模型采纳具有不同价值观与人格特质的各种视角的能力。在实验中,我们使用心理学问卷(PVQ、VSM、IPIP)来研究所展现的价值观与人格特质如何随不同视角而变化。通过定性实验,我们表明 LLM 在提示中(隐含或显式地)暗示某些价值观时会表达不同的价值观,并且即使未明显暗示时也会表达不同价值观(展示了其依赖语境的特性)。随后我们进行定量实验,研究不同模型(GPT-4、GPT-3.5、OpenAssistant、StableVicuna、StableLM)的可控性、各种诱导视角方法的有效性,以及模型可驱动性的平滑度。最后我们考察了工作的更广泛影响,并概述了相关的各类科学问题。项目网站位于 https://sites.google.com/view/llm-superpositions 。

关键词

引用

@article{arxiv.2307.07870,
  title  = {Large Language Models as Superpositions of Cultural Perspectives},
  author = {Grgur Kovač and Masataka Sawayama and Rémy Portelas and Cédric Colas and Peter Ford Dominey and Pierre-Yves Oudeyer},
  journal= {arXiv preprint arXiv:2307.07870},
  year   = {2023}
}

备注

Preprint