面向演示视频的增强分割与可视化
多媒体
2007-05-23 v1 信息检索
摘要
我们通过分别考虑音频和视觉数据,研究了演示视频的分割、可视化和索引方法。音频轨道按说话人分割,并利用自动语音识别器 (ASR) 提取的关键短语进行增强。视频轨道按视觉差异分割,并通过代表性关键帧进行增强。一个交互式用户界面结合了音频、视频、文本和关键帧的可视化表示,允许用户浏览演示视频。我们还探索了说话人数据的聚类和标注,并给出了初步结果。
引用
@article{arxiv.cs/0501044,
title = {Augmented Segmentation and Visualization for Presentation Videos},
author = {Alexander Haubold and John R. Kender},
journal= {arXiv preprint arXiv:cs/0501044},
year = {2007}
}