首先不伤害:AI 监督员如何在辅导员教育中支架化引导初学者成长
计算与语言
2026-05-12 v3
摘要
初学者辅导员最危险的错误并非显而易见的错误:他们说的话听起来像是关怀,却悄悄违反了职业伦理,使脆弱的客户保护得更不到。这一 AI 监督员并不取代初学者辅导员,而是帮助他们内化他们本不会注意到的伦理违规。使该监督员具备非平凡性并非检测问题,而是教学:它必须定位伦理违规的言语,诊断这些违规行为并对 APA 原则进行诊断,交付反馈,解释不仅事情出错在哪里,为什么是有风险的,以及如何以不同方式来应对。核心障碍在于:(1)伦理违规在实际临床数据中天然是无标签的;(2)仅针对正确答案进行训练的现有 AI 辅导员永远无法学习教学。我们一次性解决了这两个问题:一个可控的 AI 初学者会故意执行预定义的错误类别,使监督标签自然成为生成的副产品,产生了包含 9,915 条人工监督数据集的 ETHICSCAFF;GRPO 在 Novice Growth Reward(NGR)下进行优化,使监督员不为答案的正确性,而是为较弱的初学者模型在阅读其解释后是否实际提升。实验表明,由本监督员指导的初学者在临床指标上战胜了未受指导的同伴,NGR 进一步锐化了监督员自身的伦理检测能力。在针对初学者辅导心理学学生的使用者研究中,受试者在接受 AI 监督反馈后,在所有八项评估技能中均显示出显著的自我效能提升,证明该支架从模拟环境成功迁移到实际场景。
引用
@article{arxiv.2508.09042,
title = {First, Do No Harm: AI Supervisor Scaffolds Novice Growth in Counselor Education},
author = {Chen Xu and Zhenyu Lyu and Tian Lan and Yi Yang and Yu Ji and Luyao Ji and Jian Shen and Zhihua Wang and Leyang Cui and Jieshuo Zhang and Qunxi Dong and Minqiang Yang and Juan Wang and Xiuling Liu and Bin Hu},
journal= {arXiv preprint arXiv:2508.09042},
year = {2026}
}
备注
9 pages, 5 figures