中文

访问时机作为脚手架:面向教育的强化学习方法

计算机与社会 2026-05-27 v2 人工智能 人机交互

摘要

近年来,生成式 AI(GenAI)在大学学生日常生活中已广泛普及,尽管其潜在风险包括过度依赖、认知元程度 disengagement 以及学习下降。虽然大多数前期研究聚焦于如何教育学性脚手架化其使用,但何时允许使用即插式 GenAI 仍缺乏研究,且缺乏以教育学为基础的实证调查。我们将访问时机本身视为一种隐式脚手架,并通过一个强化学习(RL)代理来操作化化,该代理决定学生何时访问 GenAI,其奖励函数基于认知元理论、认知负荷理论和富有成效的失败。我们进行的一项包含 N=105 名高等教育学生的混合方法受控实验中,比较了该代理对学习收益和认知元程度参与度的影响,分别与未限制使用和完全限制使用进行了对比。结果表明,在强化学习条件下,策略性时机访问 GenAI 可提高客观后测表现和认知元程度准确性,同时减少任务错误和作业时间,优于完全禁用和完全不限制的访问,无需明确的认知元提示或结构化脚手架。然而,未在自我报告的认知元程度意识之间发现条件差异。总体而言,GenAI 访问时机是一种可行的、以理论为基础且可扩展的教育策略,优于完全不限制和完全禁用的访问,兼容即插式工具,潜在采用障碍低。这开启辩论了如何通过教育者和人机学习系统设计来促进访问时机的研究领域。

关键词

引用

@article{arxiv.2605.15850,
  title  = {Access Timing as Scaffolding: A Reinforcement Learning Approach to GenAI in Education},
  author = {Janne Rotter and Pau Benazet i Montobbio and Davinia Hernández-Leo},
  journal= {arXiv preprint arXiv:2605.15850},
  year   = {2026}
}