中文

价值万花筒:让AI参与多元人类价值、权利与义务的互动

计算与语言 2024-04-03 v2 人工智能

摘要

人类价值对人类决策至关重要。价值多元主义认为,多种正确的价值可能彼此相互牵制(例如,当考虑为保护朋友感情而对其说谎时,如何在诚实与友谊之间取得平衡?)。作为统计学习器,AI系统默认拟合平均值,从而抹去了这些可能不可约的价值冲突。为改进AI系统以更好地反映价值多元主义,首要挑战是探究AI系统在多大程度上能够建模多元人类价值、权利与义务及其相互作用。我们引入ValuePrism,一个包含与31k个人类书写情境相连的218k个价值、权利与义务的大规模数据集。ValuePrism的情境化价值由GPT-4生成,且在91%的情况下被人类标注者认为质量高。我们开展了一项涵盖多元社会与人口背景标注者的大规模研究,试图理解其所代表的是谁的价值。借助ValuePrism,我们构建了Kaleido,一个开放、轻量且结构化的基于语言的多任务模型,可在特定语境中生成、解释并评估人类价值、权利与义务的相关性及其效价(即支持或反对)。人类更偏好我们系统输出的值集合而非教师模型GPT-4,认为它们更准确且覆盖更广。此外,我们展示了Kaleido可通过输出对比性价值来帮助解释人类决策中的变异性。最后,我们表明Kaleido的表征可迁移至其他哲学框架与数据集,证实了显式、模块化且可解释的价值多元主义方法之益处。我们希望我们的工作能成为一步,使人类决策背后的隐式价值更加显式,并引导AI系统做出更符合这些价值的决策。

关键词

引用

@article{arxiv.2309.00779,
  title  = {Value Kaleidoscope: Engaging AI with Pluralistic Human Values, Rights, and Duties},
  author = {Taylor Sorensen and Liwei Jiang and Jena Hwang and Sydney Levine and Valentina Pyatkin and Peter West and Nouha Dziri and Ximing Lu and Kavel Rao and Chandra Bhagavatula and Maarten Sap and John Tasioulas and Yejin Choi},
  journal= {arXiv preprint arXiv:2309.00779},
  year   = {2024}
}

备注

Proceedings of the AAAI Conference on Artificial Intelligence, 38