面向精神健康的AI负责任评估
计算机与社会
2026-04-29 v2 人工智能
摘要
尽管人工智能(AI)在精神健康领域展现出日益巨大的潜力,但当前对该领域AI工具的评估方法仍不完整且未与临床实践、社会背景和用户第一手经验保持一致。本文主张重新思考负责任的评估——即衡量什么、由谁进行、以及出于何种目的——通过引入一种跨学科框架,将临床可靠性、社会背景和公平性整合在内,为评估提供结构化基础。通过分析135项近期*CL出版物,我们确定了常见的局限性,包括过度依赖不涵盖临床有效性、治疗适当性或用户体验的通用指标、精神健康专业人员参与度有限以及对安全性和公平性关注不足。为弥补这些差距,我们提出了一种AI精神健康支持类型的分类法——评估型、干预型和信息综合型——每种类型都有其独特的风险和评估要求,并通过案例研究展示了其应用。
引用
@article{arxiv.2602.00065,
title = {Responsible Evaluation of AI for Mental Health},
author = {Hiba Arnaout and Anmol Goel and H. Andrew Schwartz and Steffen T. Eberhardt and Dana Atzil-Slonim and Gavin Doherty and Brian Schwartz and Wolfgang Lutz and Tim Althoff and Munmun De Choudhury and Hamidreza Jamalabadi and Raj Sanjay Shah and Flor Miriam Plaza-del-Arco and Dirk Hovy and Maria Liakata and Iryna Gurevych},
journal= {arXiv preprint arXiv:2602.00065},
year = {2026}
}