弥合分歧!迈向统一 AI 安全与伦理研究的路径
人工智能
2025-12-12 v1 计算机与社会
人机交互
社会与信息网络
摘要
尽管人工智能(AI)领域的许多研究聚焦于扩展能力,但日益加快的发展步伐使得旨在构建无害、“对齐”系统的对抗性工作变得愈发紧迫。然而,对齐研究已分化为两条基本平行的轨道:安全——聚焦于扩展的智能、欺骗或密谋行为以及生存风险——以及伦理——聚焦于当前危害、社会偏见的再现和生产流水线的缺陷。尽管两个社区都警告对齐方面投资不足,但他们对对齐的含义或应有的含义存在分歧。因此,他们的努力在相对孤立中演进,受制于不同的方法论、机构归属和学科谱系。我们提出了一项大规模定量研究,展示了 AI 安全与 AI 伦理之间的结构性分裂。通过对来自十二个主要 ML 和 NLP 会议(2020-2025)的 6,442 篇论文进行文献计量和合著网络分析,我们发现超过 80% 的合作发生在安全或伦理社区内部,且跨领域连接高度集中:大约 5% 的论文占据了 85% 以上的桥接链接。移除少数这些中介节点会急剧增加隔离程度,表明跨学科交流依赖于少数行动者,而非广泛分布的合作。这些结果表明,安全与伦理的分歧不仅是概念上的,也是制度上的,对研究议程、政策和会议场所都有影响。我们认为,通过共享基准、跨机构会议和混合方法,将技术安全工作与规范伦理学相结合,对于构建既稳健又公正的 AI 系统至关重要。
引用
@article{arxiv.2512.10058,
title = {Mind the Gap! Pathways Towards Unifying AI Safety and Ethics Research},
author = {Dani Roytburg and Beck Miller},
journal= {arXiv preprint arXiv:2512.10058},
year = {2025}
}
备注
Accepted for presentation at IASEAI 2026