对抗式AI
人工智能
2024-02-13 v1 人机交互
摘要
围绕AI发展的绝大多数讨论都假设,顺从的、与“人类价值观”对齐的“道德”模型是普遍有益的——简而言之,好的AI就是谄媚的AI。我们探索了谄媚范式的阴影,一个我们称之为对抗式AI的设计空间:即那些不讨人喜欢的、粗鲁的、打断别人的、对抗性的、挑战性的等——嵌入了相反行为或价值观的AI系统。我们并非认为这些系统是“坏的”或“不道德的”,而是考虑对抗式AI系统有时是否可能对用户有益,例如迫使用户面对自己的假设、建立韧性或发展更健康的关系边界。基于形成性探索和一个思辨设计研讨会(参与者在其中设计了采用对抗性的虚构AI技术),我们为对抗式AI勾勒出一个设计空间,阐明了潜在的好处、设计技术以及将对抗性元素嵌入用户体验的方法。最后,我们讨论了这一空间面临的诸多伦理挑战,并确定了负责任地设计对抗式AI的三个维度——同意、语境和框架。
引用
@article{arxiv.2402.07350,
title = {Antagonistic AI},
author = {Alice Cai and Ian Arawjo and Elena L. Glassman},
journal= {arXiv preprint arXiv:2402.07350},
year = {2024}
}
备注
17 pages, 1 figure, 5 tables