PedaCo-Gen:在人机协作视频 authoring 中筑起教学主体性
计算机视觉与模式识别
2026-03-30 v2 人工智能
人机交互
摘要
尽管文本到视频(Text-to-Video, T2V)生成AI的进步为实现内容创建的民主化提供了前景,但当前模型往往针对视觉保真度进行优化,而非教学效果。本研究引入PedaCo-Gen,一个受马克的认知多媒体学习理论(Mayer's Cognitive Theory of Multimedia Learning, CTML)指导的人机协作视频生成系统,用于根据教学原则生成教学视频。我们摆脱传统的“一次性”生成模式,引入中间表示(Intermediate Representation, IR)阶段,使教育者能够交互式地审阅和细化视频蓝图——包括脚本和视觉描述——与AI审阅者协作。我们的研究涉及23名教育专家,表明PedaCo-Gen在各种主题和CTML原则下均显著优于基线方法。参与者认为AI驱动的指导不仅是一套指令,而是一种元认知支架,增强了他们的教学设计专业能力,报告称生产效率(M=4.26)和指导效度(M=4.04)均很高。这些发现凸显了通过原则化协作重建教学主体性的重要性,为未来融合生成力量与人类专业 expertise 的AI authoring工具提供了基础。
引用
@article{arxiv.2602.19623,
title = {PedaCo-Gen: Scaffolding Pedagogical Agency in Human-AI Collaborative Video Authoring},
author = {Injun Baek and Yearim Kim and Nojun Kwak},
journal= {arXiv preprint arXiv:2602.19623},
year = {2026}
}