人工智能系统的标识符
人工智能
2024-10-30 v3
摘要
人工智能系统日益普及,但决定是否以及如何与之交互所需的信息可能不存在或无法获取。用户可能无法验证系统是否具有某些安全认证。当系统引发事故时,调查人员可能不知道应该调查谁。可能不清楚联系谁来关闭一个出现故障的系统。在许多领域中,标识符通过识别特定实体(例如,一架特定的波音747)并提供关于同一类别其他实体(例如,部分或全部波音747)的信息来解决类似问题。我们提出了一个框架,在该框架中,标识符被赋予给人工智能系统的实例(例如,与Claude 3的特定聊天会话),并且相关信息可供寻求与该系统交互的各方访问。我们描述了人工智能系统标识符的特征,提供了标识符可能有用的具体示例,论证了关键参与者可能对标识符有显著需求,分析了这些参与者如何激励标识符的采用,探索了为人工智能系统部署者实施我们框架的潜在方案,并强调了局限性和风险。在人工智能系统可能对世界产生重大影响的场景中,例如进行金融交易或联系真实人类时,标识符似乎最为必要。通过进一步研究,标识符可能有助于管理一个人工智能系统渗透社会的世界。
引用
@article{arxiv.2406.12137,
title = {IDs for AI Systems},
author = {Alan Chan and Noam Kolt and Peter Wills and Usman Anwar and Christian Schroeder de Witt and Nitarshan Rajkumar and Lewis Hammond and David Krueger and Lennart Heim and Markus Anderljung},
journal= {arXiv preprint arXiv:2406.12137},
year = {2024}
}
备注
Under review; accepted to RegML workshop at NeurIPS 2024