中文

面向负责任的人工智能以实现测试公平性与质量:基于Duolingo English Test的案例研究

计算机与社会 2024-09-13 v1 人工智能 计算与语言

摘要

人工智能(AI)为评估提供了机会,例如在项目生成和口头/书面响应的评分方面的效率。然而,它也带来了风险(例如AI生成项目内容中的偏见)。负责任的人工智能(RAI)实践旨在缓解与AI相关的风险。本章节阐述了RAI实践在实现测试质量(测试得分推断的合适性)和测试公平性(对所有考生的公平性)中的关键作用。为此,本章节采用Duolingo English Test(DET),一种由AI驱动的高风险英语语言评估,进行案例研究。本章讨论了DET的RAI标准、其开发过程以及其与领域无关RAI原则的关系。此外,本章提供了具体RAI实践的示例,展示了这些实践如何有力地解决有效性与可靠性、公平性、隐私与安全、透明度与问责制等伦理原则,以确保测试公平性与质量。

关键词

引用

@article{arxiv.2409.07476,
  title  = {Responsible AI for Test Equity and Quality: The Duolingo English Test as a Case Study},
  author = {Jill Burstein and Geoffrey T. LaFlair and Kevin Yancey and Alina A. von Davier and Ravit Dotan},
  journal= {arXiv preprint arXiv:2409.07476},
  year   = {2024}
}