价值对齐能动性(自然与人工)的语言盲点
人工智能
2022-07-05 v1 计算与语言
计算机与社会
机器学习
摘要
人工智能(AI)的价值对齐问题探讨我们如何确保人工系统的“价值”(即目标函数)与人类的价值相对齐。在本文中,我认为语言交流(自然语言)是鲁棒价值对齐的必要条件。我讨论了若此主张为真,对于试图确保 AI 系统价值对齐、或更宏大地说设计鲁棒有益或合乎伦理的人工能动体的研究纲领所将产生的后果。
引用
@article{arxiv.2207.00868,
title = {The Linguistic Blind Spot of Value-Aligned Agency, Natural and Artificial},
author = {Travis LaCroix},
journal= {arXiv preprint arXiv:2207.00868},
year = {2022}
}
备注
49 pages; 2 Figures; 1 Table; -- Under Review