中文

对抗式AI

人工智能 2024-02-13 v1 人机交互

摘要

围绕AI发展的绝大多数讨论都假设,顺从的、与“人类价值观”对齐的“道德”模型是普遍有益的——简而言之,好的AI就是谄媚的AI。我们探索了谄媚范式的阴影,一个我们称之为对抗式AI的设计空间:即那些不讨人喜欢的、粗鲁的、打断别人的、对抗性的、挑战性的等——嵌入了相反行为或价值观的AI系统。我们并非认为这些系统是“坏的”或“不道德的”,而是考虑对抗式AI系统有时是否可能对用户有益,例如迫使用户面对自己的假设、建立韧性或发展更健康的关系边界。基于形成性探索和一个思辨设计研讨会(参与者在其中设计了采用对抗性的虚构AI技术),我们为对抗式AI勾勒出一个设计空间,阐明了潜在的好处、设计技术以及将对抗性元素嵌入用户体验的方法。最后,我们讨论了这一空间面临的诸多伦理挑战,并确定了负责任地设计对抗式AI的三个维度——同意、语境和框架。

关键词

引用

@article{arxiv.2402.07350,
  title  = {Antagonistic AI},
  author = {Alice Cai and Ian Arawjo and Elena L. Glassman},
  journal= {arXiv preprint arXiv:2402.07350},
  year   = {2024}
}

备注

17 pages, 1 figure, 5 tables