中文

技术报告:时序聚合表示

计算机视觉与模式识别 2021-06-16 v2

摘要

本技术报告以更多实验扩展了我们在 [9] 中呈现的工作。在 [9] 中,我们处理长期视频理解,这需要从当前及过去或未来的观测中进行推理,并提出了若干基本问题:应如何对时序或序列关系建模?需要处理多长时序范围的信息与上下文?应以何种时间尺度推导它们?[9] 通过一个灵活的多粒度时序聚合框架解决了这些问题。在本报告中,我们使用该框架在不同任务和一个新数据集 EPIC-KITCHENS-100 上进行了进一步实验。

关键词

引用

@article{arxiv.2106.03152,
  title  = {Technical Report: Temporal Aggregate Representations},
  author = {Fadime Sener and Dibyadip Chatterjee and Angela Yao},
  journal= {arXiv preprint arXiv:2106.03152},
  year   = {2021}
}