通过去中心化承诺装置实现协作式 AI
人工智能
2023-11-15 v1 密码学与安全
计算机科学与博弈论
多智能体系统
摘要
可信承诺装置一直是稳健多智能体协调的流行方法。然而,现有承诺机制面临隐私、完整性以及易受中介或用户策略行为影响等局限。尚不清楚我们所研究的协作式 AI 技术是否对现实世界激励与攻击向量具有鲁棒性。不过,利用密码学的去中心化承诺装置已在现实中部署,且大量研究显示了其在面对具有显著经济激励(目前规模达数百万至数十亿美元量级)的对抗性对手时协调算法智能体的能力。本文中,我们使用去中心化尤其是最大可提取价值(MEV)(arXiv:1904.05234)文献中的例子来说明协作式 AI 中的潜在安全问题。我们呼吁拓展对去中心化承诺的研究,以提升协作式 AI 在开放环境中安全协调的能力,并建立经验测试框架以在给定现实承诺约束下评估多智能体协调能力。
引用
@article{arxiv.2311.07815,
title = {Cooperative AI via Decentralized Commitment Devices},
author = {Xinyuan Sun and Davide Crapis and Matt Stephenson and Barnabé Monnot and Thomas Thiery and Jonathan Passerat-Palmbach},
journal= {arXiv preprint arXiv:2311.07815},
year = {2023}
}
备注
NeurIPS 2023- Multi-Agent Security Workshop