YLI-MED 语料库:特征、流程与计划
多媒体
2015-03-17 v1 计算与语言
摘要
YLI 多媒体事件检测语料库是一个带有标注和计算特征的视频公共索引,专用于多媒体事件检测(MED)研究,即通过分析音频和视觉内容自动识别视频中正在发生的事情。YLI-MED 语料库中索引的视频是更大的 YLI 特征语料库的一个子集,后者由国际计算机科学研究所(International Computer Science Institute)和劳伦斯利弗莫尔国家实验室(Lawrence Livermore National Laboratory)基于 Yahoo Flickr Creative Commons 100 Million (YFCC100M) 数据集开发。YLI-MED 中的视频被分类为描绘十个目标事件之一或无目标事件,并标注了额外属性,如所说语言和视频是否有配乐。标注还包括标注者一致程度和每个视频事件分类的平均标注者置信度分数。YLI-MED 的 1.0 版本包含 1823 个描绘目标事件的“正”视频和 48,138 个“负”视频,以及 177 个类似于事件视频但非正例的补充视频。我们制作 YLI-MED 的目标是尽可能开放我们的数据和流程。本报告描述了用于收集该语料库的流程;给出了关于语料库构成的详细描述统计(以及视频属性如何影响标注者的判断);讨论了我们的流程选择可能引入的语料库偏置,并将其与最相似的现有数据集 TRECVID MED 的 HAVIC 语料库比较;并概述了我们扩展标注工作的未来计划。
引用
@article{arxiv.1503.04250,
title = {The YLI-MED Corpus: Characteristics, Procedures, and Plans},
author = {Julia Bernd and Damian Borth and Benjamin Elizalde and Gerald Friedland and Heather Gallagher and Luke Gottlieb and Adam Janin and Sara Karabashlieva and Jocelyn Takahashi and Jennifer Won},
journal= {arXiv preprint arXiv:1503.04250},
year = {2015}
}
备注
47 pages; 3 figures; 25 tables. Also published as ICSI Technical Report TR-15-001