位置:为提问而解释,而非为辩护
人工智能
2024-07-30 v2 密码学与安全
机器学习
摘要
可解释人工智能(XAI)是一个虽年轻但极具前景的研究领域。不幸的是,该领域的进展目前因目标不一致、彼此 incompatible 而受到阻碍。我们将 XAI 领域中纠结的诸多线索划分为两大互补的文化:以人类/价值观为导向的解释(BLUE XAI)和以模型/验证为导向的解释(RED XAI)。本立场论文认为,RED XAI 领域目前严重不足,即迫切需要更多方法来质疑模型(例如从高性能模型中提取知识,以及识别并修复故障模型中的错误),而 RED XAI 所蕴含的机遇与潜力,对于确保 AI 系统安全具有重要的研究需求。我们通过呈现该领域的有前景的挑战,总结了本文。
引用
@article{arxiv.2402.13914,
title = {Position: Explain to Question not to Justify},
author = {Przemyslaw Biecek and Wojciech Samek},
journal= {arXiv preprint arXiv:2402.13914},
year = {2024}
}