TASRA:人工智能社会尺度风险的分类与分析
人工智能
2023-06-16 v2 密码学与安全
计算机与社会
机器学习
摘要
尽管近期若干工作已识别出人工智能对人类造成的社会尺度乃至灭绝级风险,但鲜有尝试对此类风险进行穷尽式分类。多种穷尽式分类法皆有可能,其中一些是有用的——尤其是当它们揭示出新风险或实用的安全应对途径时。本文探讨一种基于问责制的分类法:何种行为导致风险、行为者是否统一、以及其行为是否蓄意?我们还提供了故事以阐释各类风险类型各自可能的演变,包括由众多AI系统间未预期交互引发的风险,以及蓄意滥用所致的风险,后者指向技术与政策相结合的解决方案。
引用
@article{arxiv.2306.06924,
title = {TASRA: a Taxonomy and Analysis of Societal-Scale Risks from AI},
author = {Andrew Critch and Stuart Russell},
journal= {arXiv preprint arXiv:2306.06924},
year = {2023}
}