"一个伟大的开始,但...":评估 LLM 生成的思维导图在视频基础设计中的信息映射
人机交互
2025-01-17 v1
摘要
从视频中提取概念并理解其间关系是视频基础设计(VBD)中的关键任务,该方法将视频作为探索的主要介质,但需要大量 effort 来管理 meta 信息。思维导图凭借其可视化组织复杂数据的能力,为结构化和分析视频内容提供了有前景的途径。近期大型语言模型(LLM)的快速发展为 VBD 中的 meta 信息处理和视觉理解提供了新的机遇,但其应用仍未得到充分探索。本研究邀请了28名 VBD 实践者,探讨了使用经过微调的 LLM 从人类学视频生成思维导图的用法。将 LLM 生成的思维导图与专业设计师创建的思维导图进行比较,我们评估了评分得分、设计效果和用户体验在两个情境中的情况。研究发现,LLM 能够有效捕获中心概念,但在层次化组织和情境 grounding 上存在挑战。我们讨论了信任、定制和工作流程集成作为引导 LLM 支持 VBD 中信息映射未来研究的关键因素。
关键词
引用
@article{arxiv.2501.09457,
title = {"A Great Start, But...": Evaluating LLM-Generated Mind Maps for Information Mapping in Video-Based Design},
author = {Tianhao He and Karthi Saravanan and Evangelos Niforatos and Gerd Kortuem},
journal= {arXiv preprint arXiv:2501.09457},
year = {2025}
}