强类型智能体保证安全交互
机器学习
2018-06-07 v2 人工智能
计算机科学与博弈论
摘要
随着人工智能体日益增多,确保它们彼此之间的交互行为良好变得愈发重要。在本文中,我们将算法行为良好的常识性概念形式化:如果算法不造成伤害,则它是安全的。受深度学习近期进展的启发,我们聚焦于智能体根据梯度下降更新其动作的具体情况。本文表明,在安全博弈中梯度下降会收敛到 Nash 均衡。主要贡献是定义了强类型智能体并证明它们保证能够安全交互,从而提供了保证安全交互的充分条件。一系列示例表明,强类型化推广了凸性的某些关键特征,与盲源分离密切相关,并基于张量分解引入了关于经典多线性博弈的新视角。
引用
@article{arxiv.1702.07450,
title = {Strongly-Typed Agents are Guaranteed to Interact Safely},
author = {David Balduzzi},
journal= {arXiv preprint arXiv:1702.07450},
year = {2018}
}
备注
ICML 2017, final version