技术报告:时序聚合表示
计算机视觉与模式识别
2021-06-16 v2
摘要
本技术报告以更多实验扩展了我们在 [9] 中呈现的工作。在 [9] 中,我们处理长期视频理解,这需要从当前及过去或未来的观测中进行推理,并提出了若干基本问题:应如何对时序或序列关系建模?需要处理多长时序范围的信息与上下文?应以何种时间尺度推导它们?[9] 通过一个灵活的多粒度时序聚合框架解决了这些问题。在本报告中,我们使用该框架在不同任务和一个新数据集 EPIC-KITCHENS-100 上进行了进一步实验。
引用
@article{arxiv.2106.03152,
title = {Technical Report: Temporal Aggregate Representations},
author = {Fadime Sener and Dibyadip Chatterjee and Angela Yao},
journal= {arXiv preprint arXiv:2106.03152},
year = {2021}
}