中文

写作评估中的AI生成文章检测:负责任的使用与跨LLM的可推广性

计算与语言 2026-03-05 v2

摘要

写作是一种基础语言技能,支撑着有效沟通,促进批判性思维,促进跨学科学习,使个体能够组织和表达复杂想法。因此,写作评估在评估语言熟练程度、沟通效果以及分析推理能力方面发挥着关键作用。大型语言模型(LLM)的快速发展使得生成连贯、高质量的文章变得越来越容易,引发了对学生提交作品真实性的重大担忧。本章首先概述当前用于检测AI生成和AI辅助文章的检测器概况,以及负责任使用的指南。随后,我们基于针对公开GRE写作提示生成的文章,进行经验分析,评估训练一个LLM生成的文章检测器对识别其他LLM生成的文章的泛化能力。这些发现为开发和重新训练检测器以用于实际应用提供了指导。

关键词

引用

@article{arxiv.2603.02353,
  title  = {Detecting AI-Generated Essays in Writing Assessment: Responsible Use and Generalizability Across LLMs},
  author = {Jiangang Hao},
  journal= {arXiv preprint arXiv:2603.02353},
  year   = {2026}
}

备注

21 pages, 2 figures