“冷静、计算且傲慢”:AI如何识别并解释能主义,与禁障者的比较
人机交互
2025-06-03 v3 人工智能
摘要
拥有障碍者(PwD)在线上常常遭遇能主义仇恨和微歧视。这些空间通常由机器学习模型进行内容 moderation,但关于AI模型如何有效识别能主义言论以及其判断是否与PwD一致方面已知甚少。为此,我们策划了一个首个其类数据集,包含200条针对PwD的社交媒体评论,并引导先进AI模型(即毒性分类器、大语言模型)对每条评论进行毒性与能主ism评分,并解释其推理。随后,我们招募了190名参与者类似地对评论进行评分与解释,并评估LLM的解释。我们的混合方法分析揭示了主要脱节:AI对毒性的估计低于PwD的评分,而其对能主ism的评估则不稳定且差异大。尽管LLM识别了一些偏见,但其解释存在缺陷——缺乏细微差别,作出错误假设,显得偏见且非教育性。展望未来,我们讨论了在能主ism内容 moderation系统设计中所面临的挑战与机遇,倡导在AI中加入具交叉性的禁障者视角。
引用
@article{arxiv.2410.03448,
title = {"Cold, Calculated, and Condescending": How AI Identifies and Explains Ableism Compared to Disabled People},
author = {Mahika Phutane and Ananya Seelam and Aditya Vashistha},
journal= {arXiv preprint arXiv:2410.03448},
year = {2025}
}