AI武器与影响:前沿模型在模拟核危机中的高级推理
人工智能
2026-02-17 v1 计算机与社会
计算机科学与博弈论
摘要
当今领先的人工智能模型在战略竞争情境中展现出精妙的行为。它们自行尝试欺骗,传递出并非真实意图的信号;展示出丰富的心智理论,推理对手的信念并预测其行动;展现出可信的元认知自我意识,评估自身的战略能力后决定行动方式。我们 presented of一场危机模拟,其中三个前沿大型语言模型(GPT-5.2、Claude Sonnet 4、Gemini 3 Flash)在核危机中扮演对立的领袖。我们的模拟直接适用于国家安全专业人士,也通过洞察AI在不确定性下的推理,远超国际危机决策。我们的发现既验证又挑战了战略理论的核心原则。我们发现支持谢尔宾关于承诺的想法、康的升级框架以及杰弗里斯关于误判的工作等。然而我们也发现,核禁忌并非阻止我们的模型进行核升级;战略核攻击虽然罕见,但确实发生;威胁往往引发反升级而非遵从;高互惠信任反而加速而非阻止冲突;且没有模型在紧急压力下选择让步或撤退,仅减少暴力程度。我们认为,AI模拟是一种强大的战略分析工具,但只有在正确校准于已知的人类推理模式后才能实现。理解前沿模型如何模仿以及不模仿人类战略逻辑,对日益影响AI的战略结果的世界至关重要。
引用
@article{arxiv.2602.14740,
title = {AI Arms and Influence: Frontier Models Exhibit Sophisticated Reasoning in Simulated Nuclear Crises},
author = {Kenneth Payne},
journal= {arXiv preprint arXiv:2602.14740},
year = {2026}
}
备注
45 pages, 6 figures, 27 tables