中文

“你能看见我思考吗?”将 LLM 反馈 grounded 在按键和修订模式中

人机交互 2025-08-20 v1

摘要

随着大型语言模型(LLM)日益增多地帮助评估学生写作,研究人员开始质疑这些模型是否具有认知 grounding,即它们是否仅仅关注最终产品,还是关注其撰写过程。本研究探索了将写作过程数据(具体为按键日志和带时间戳的快照)纳入 LLM 生成反馈中的影响。我们对 52 篇学生作文进行消融研究,比较仅使用最终作文(C1)和同时包含按键日志和带时间戳快照的反馈(C2)之间的差异。虽然评分标准几乎没有变化,但 C2 生成的反馈在结构评估和更注重过程的论证方面显著优于 C1。

关键词

引用

@article{arxiv.2508.13543,
  title  = {"Can You See Me Think?" Grounding LLM Feedback in Keystrokes and Revision Patterns},
  author = {Samra Zafar and Shifa Yousaf and Muhammad Shaheer Minhas},
  journal= {arXiv preprint arXiv:2508.13543},
  year   = {2025}
}

备注

15 pages, 4 figures, 6 tables, Submitted to IJCNLP-AACL 2025