人工智能的承诺与危险——紫队方法提供一条平衡的前进路径
人工智能
2023-08-29 v1 密码学与安全
机器学习
摘要
人工智能(AI)在各行业承诺带来巨大益处,但也因双重用途潜力、偏见和意外行为而带来风险。本文回顾了不透明且不可控的 AI 系统所涌现的问题,并提出了一种称为紫队(violet teaming)的综合框架以开发可靠且负责任的 AI。紫队将对抗性漏洞探测(红队)与安全和安保解决方案(蓝队)相结合,同时优先考虑伦理和社会效益。它源于 AI 安全研究,旨在通过设计主动管理风险。本文追溯了红队、蓝队和紫队向紫队演进的过程,随后讨论了将紫队技术应用于应对生物技术中 AI 的生物安全风险。其他章节回顾了法律、伦理、网络安全、宏观战略和行业最佳实践中的关键视角,这些对于通过整体技术和社会考量来落实负责任的 AI 至关重要。紫队提供了将 AI 发展轨迹导向社会福祉的哲学与方法。凭借良知与智慧,AI 的非凡能力可造福人类。但若无充分预防,风险可能是灾难性的。紫队旨在赋能面向共同福祉的道德技术。
引用
@article{arxiv.2308.14253,
title = {The Promise and Peril of Artificial Intelligence -- Violet Teaming Offers a Balanced Path Forward},
author = {Alexander J. Titus and Adam H. Russell},
journal= {arXiv preprint arXiv:2308.14253},
year = {2023}
}
备注
14 pages, 1 figure