全球AI安全研究优先事项的新加坡共识
人工智能
2025-07-02 v2 计算机与社会
摘要
快速发展的AI能力和自主性具有巨大的变革潜力,但也正在推动关于如何确保AI安全(即可信、可靠和安全)的激烈讨论。因此,建立可信的生态系统至关重要——它帮助人们充满信心地拥抱AI,同时在避免反弹的同时为创新提供最大空间。2025年新加坡AI会议(SCAI)旨在通过邀请来自不同地区的AI科学家,识别并综合AI安全领域的研究优先事项,以支持这一领域的研究。该报告建立在由Yoshua Bengio主持并得到33个政府支持的国际AI安全报告基础上。该报告采用防御性深度模型(defence-in-depth model),将AI安全研究领域组织分为三类:创建可信AI系统的挑战(Development)、评估其风险的挑战(Assessment),以及部署后监控和干预的挑战(Control)。
引用
@article{arxiv.2506.20702,
title = {The Singapore Consensus on Global AI Safety Research Priorities},
author = {Yoshua Bengio and Tegan Maharaj and Luke Ong and Stuart Russell and Dawn Song and Max Tegmark and Lan Xue and Ya-Qin Zhang and Stephen Casper and Wan Sie Lee and Sören Mindermann and Vanessa Wilfred and Vidhisha Balachandran and Fazl Barez and Michael Belinsky and Imane Bello and Malo Bourgon and Mark Brakel and Siméon Campos and Duncan Cass-Beggs and Jiahao Chen and Rumman Chowdhury and Kuan Chua Seah and Jeff Clune and Juntao Dai and Agnes Delaborde and Nouha Dziri and Francisco Eiras and Joshua Engels and Jinyu Fan and Adam Gleave and Noah Goodman and Fynn Heide and Johannes Heidecke and Dan Hendrycks and Cyrus Hodes and Bryan Low Kian Hsiang and Minlie Huang and Sami Jawhar and Wang Jingyu and Adam Tauman Kalai and Meindert Kamphuis and Mohan Kankanhalli and Subhash Kantamneni and Mathias Bonde Kirk and Thomas Kwa and Jeffrey Ladish and Kwok-Yan Lam and Wan Lee Sie and Taewhi Lee and Xiaojian Li and Jiajun Liu and Chaochao Lu and Yifan Mai and Richard Mallah and Julian Michael and Nick Moës and Simon Möller and Kihyuk Nam and Kwan Yee Ng and Mark Nitzberg and Besmira Nushi and Seán O hÉigeartaigh and Alejandro Ortega and Pierre Peigné and James Petrie and Benjamin Prud'Homme and Reihaneh Rabbany and Nayat Sanchez-Pi and Sarah Schwettmann and Buck Shlegeris and Saad Siddiqui and Aradhana Sinha and Martín Soto and Cheston Tan and Dong Ting and William Tjhi and Robert Trager and Brian Tse and Anthony Tung K. H. and Vanessa Wilfred and John Willes and Denise Wong and Wei Xu and Rongwu Xu and Yi Zeng and HongJiang Zhang and Djordje Žikelić},
journal= {arXiv preprint arXiv:2506.20702},
year = {2025}
}
备注
Final report from the "2025 Singapore Conference on AI (SCAI)" held April 26: https://www.scai.gov.sg/2025/scai2025-report