中文

语料库与大语言模型中价值观、议程与观察的自下而上与自上而下分析

计算与语言 2024-11-11 v1 人工智能

摘要

大语言模型(LLM)从多种潜在视角生成多样化、情境化、具有说服力的文本,其生成受到提示和训练数据的强烈影响。随着LLM的普及,我们希望刻画——理想情况下加以管理——其所表达的社会文化价值观,出于安全性、准确性、包容性和文化保真度的考虑。我们提出了一种经过验证的自动方法,包括:(1)从文本中提取异质性的潜在价值主张,(2)评估文本与价值观之间的共鸣与冲突,以及(3)将这些操作相结合,以刻画人类来源和LLM来源的文本数据的多元价值观对齐。

关键词

引用

@article{arxiv.2411.05040,
  title  = {Bottom-Up and Top-Down Analysis of Values, Agendas, and Observations in Corpora and LLMs},
  author = {Scott E. Friedman and Noam Benkler and Drisana Mosaphir and Jeffrey Rye and Sonja M. Schmer-Galunder and Micah Goldwater and Matthew McLure and Ruta Wheelock and Jeremy Gottlieb and Robert P. Goldman and Christopher Miller},
  journal= {arXiv preprint arXiv:2411.05040},
  year   = {2024}
}