中文

强类型智能体保证安全交互

机器学习 2018-06-07 v2 人工智能 计算机科学与博弈论

摘要

随着人工智能体日益增多,确保它们彼此之间的交互行为良好变得愈发重要。在本文中,我们将算法行为良好的常识性概念形式化:如果算法不造成伤害,则它是安全的。受深度学习近期进展的启发,我们聚焦于智能体根据梯度下降更新其动作的具体情况。本文表明,在安全博弈中梯度下降会收敛到 Nash 均衡。主要贡献是定义了强类型智能体并证明它们保证能够安全交互,从而提供了保证安全交互的充分条件。一系列示例表明,强类型化推广了凸性的某些关键特征,与盲源分离密切相关,并基于张量分解引入了关于经典多线性博弈的新视角。

关键词

引用

@article{arxiv.1702.07450,
  title  = {Strongly-Typed Agents are Guaranteed to Interact Safely},
  author = {David Balduzzi},
  journal= {arXiv preprint arXiv:1702.07450},
  year   = {2018}
}

备注

ICML 2017, final version