AI安全的隐形问题——为何需要多元化团队
计算机与社会
2024-07-16 v1 人工智能
摘要
我们认为现有的AI“安全”和“对齐”方法可能未能使用最有效的工具、团队或方法。我们建议将问题视为社会科学问题,由于社会科学拥有丰富的模型工具来理解和对齐动机和行为,这些工具可被重新用于涉及AI模型的问题,并列举了原因。我们引入了一个以社会科学工具为基础、以三个步骤为特征的替代对齐方法:1. 定义面向人类/AI合作的积极社会结果作为目标或“北极星”,2. 正确地界定已知和未知,3. 组建多元化团队以调查、观察和导航对齐中出现的新挑战。
引用
@article{arxiv.2407.10254,
title = {The Elephant in the Room -- Why AI Safety Demands Diverse Teams},
author = {David Rostcheck and Lara Scheibling},
journal= {arXiv preprint arXiv:2407.10254},
year = {2024}
}
备注
9 pages