价值对齐的挑战:从更公平的算法到人工智能安全
计算机与社会
2021-01-19 v2
摘要
本文探讨了如何使人工智能系统与人类价值对齐的问题,并将其置于有关技术与价值的更广泛思想体系中。技术'锁定'不同价值体系的能力长期以来备受关注,并非孤立存在。关于如何通过参与式设计流程等具体方式使技术与特定社会价值对齐,亦有大量思考。本文更细致地审视人工智能价值对齐问题,并指出人工智能系统的强大能力与自主性在价值领域带来了前所未有的机遇与挑战。通过厘清公平、问责、透明与伦理(FATE)社群的研究与技术性人工智能安全研究者工作之间的重要连续性,我们建议应更多关注'社会价值对齐'问题——即如何使人工智能系统与人群(尤其在全球层面)所认同的多元价值保持一致。
引用
@article{arxiv.2101.06060,
title = {The Challenge of Value Alignment: from Fairer Algorithms to AI Safety},
author = {Iason Gabriel and Vafa Ghazavi},
journal= {arXiv preprint arXiv:2101.06060},
year = {2021}
}