重新思考AI如何嵌入并适应人类价值观:挑战与机遇
人工智能
2025-08-26 v1
摘要
``人类中心AI''和``基于价值的决策''的概念在研究和行业中获得了显著关注。然而,许多关键方面仍未得到充分探讨,需要进一步调查。特别是,我们需要理解系统如何整合人类价值观,人类如何在系统中识别这些价值观,以及如何最小化伤害或意外后果的风险。在本文中,我们提出需要重新思考我们如何构建价值对齐,并断言价值对齐应超越静态和单一价值观的概念。我们认为AI系统应实施长期推理并能够适应不断演变的价值观。此外,价值对齐需要更多理论来处理人类价值观的全部范围。由于价值观常在个体或群体之间存在差异,多主体系统提供了处理多样性、冲突和关于价值观的主体间推理的正确框架。我们确定了价值对齐所面临的挑战,并指出了推进价值对齐研究的方向。此外,我们广泛讨论了价值对齐的多样化视角,从设计方法到实际应用。
引用
@article{arxiv.2508.17104,
title = {Rethinking How AI Embeds and Adapts to Human Values: Challenges and Opportunities},
author = {Sz-Ting Tzeng and Frank Dignum},
journal= {arXiv preprint arXiv:2508.17104},
year = {2025}
}
备注
7 pages, accepted at VALE 2025