中文

军事与外交决策中语言模型引发的升级风险

人工智能 2024-06-13 v1 计算与语言 计算机与社会 多智能体系统

摘要

各国政府正日益考虑将自主 AI 智能体整合到高风险的军事和外交政策决策中,尤其是随着 GPT-4 等先进生成式 AI 模型的出现。我们的工作旨在审查多个 AI 智能体在模拟战争游戏中的行为,特别关注其采取可能加剧多边冲突的升级行动的倾向。借鉴关于升级动态的政治学和国际关系文献,我们设计了一种新型的战争游戏模拟和评分框架,以评估这些智能体在不同场景下所采取行动的升级风险。与 prior 研究相反,我们的研究提供了定性和定量见解,并专注于大型语言模型(LLMs)。我们发现,所有五个研究的现成 LLMs 都表现出某种形式的升级以及难以预测的升级模式。我们观察到,模型倾向于发展军备竞赛动态,导致更大的冲突,在极少数情况下甚至导致核武器的部署。在定性方面,我们还收集了模型对所选行动的报告理由,并观察到基于威慑和先发制人战术的令人担忧的辩解。鉴于军事和外交政策背景的高风险性,我们建议在部署自主语言模型智能体进行战略军事或外交决策之前进行进一步审查和谨慎考虑。

关键词

引用

@article{arxiv.2401.03408,
  title  = {Escalation Risks from Language Models in Military and Diplomatic Decision-Making},
  author = {Juan-Pablo Rivera and Gabriel Mukobi and Anka Reuel and Max Lamparth and Chandler Smith and Jacquelyn Schneider},
  journal= {arXiv preprint arXiv:2401.03408},
  year   = {2024}
}

备注

10 pages body, 57 pages appendix, 46 figures, 11 tables