2020 视频字幕预训练挑战赛综述
计算机视觉与模式识别
2020-08-04 v1
摘要
2020 视频字幕预训练挑战赛综述:结果及挑战赛参赛者的技术报告。
引用
@article{arxiv.2008.00947,
title = {Pre-training for Video Captioning Challenge 2020 Summary},
author = {Yingwei Pan and Jun Xu and Yehao Li and Ting Yao and Tao Mei},
journal= {arXiv preprint arXiv:2008.00947},
year = {2020}
}
相关论文
查看更多相关论文 →
计算机视觉与模式识别 · 计算机科学
Vatex视频描述挑战2020:用于视频描述的多视角特征与混合奖励策略
Xinxin Zhu, Longteng Guo, Peng Yao, Shichen Lu +2
2020-06-25
计算与语言 · 计算机科学
VATEX 2019 视频描述挑战赛:多模态信息融合与多阶段训练策略
Ziqi Zhang, Yaya Shi, Jiutong Wei, Chunfeng Yuan +2
2019-10-15
计算机视觉与模式识别 · 计算机科学
面向密集视频描述语义感知的预训练
Teng Wang, Zhu Liu, Feng Zheng, Zhichao Lu +2
2022-04-18
计算机视觉与模式识别 · 计算机科学
为开放词汇任务预训练图像-语言 Transformer
AJ Piergiovanni, Weicheng Kuo, Anelia Angelova
2022-09-12
计算机视觉与模式识别 · 计算机科学
用于 VATEX 2020 视频描述挑战赛的 NITS-VC 系统
Alok Singh, Thoudam Doren Singh, Sivaji Bandyopadhyay
2020-09-28
计算机视觉与模式识别 · 计算机科学
视频字幕生成:现状比较综述与可能路径
Daniela Moctezuma, Tania Ramírez-delReal, Guillermo Ruiz, Othón González-Chávez
2022-04-14
计算机视觉与模式识别 · 计算机科学
视频中密集描述事件:SYSU参加ActivityNet Challenge 2020
Teng Wang, Huicheng Zheng, Mingjing Yu
2020-08-13
计算机视觉与模式识别 · 计算机科学
图像描述生成
Vikram Mullachery, Vishal Motwani
2018-05-24
计算与语言 · 计算机科学
一项具有挑战性的多模态视频摘要:从视频中同时提取并生成关键帧-字幕对
Keito Kudo, Haruki Nagasawa, Jun Suzuki, Nobuyuki Shimizu
2023-12-05
计算机视觉与模式识别 · 计算机科学
面向 VATEX 2020 描述生成挑战的多模态特征融合与特征注意力
Ke Lin, Zhuoxin Gan, Liwei Wang
2020-06-08
计算机视觉与模式识别 · 计算机科学
CLIP4Caption:用于视频字幕生成的 CLIP 框架
Mingkang Tang, Zhanyu Wang, Zhenhua Liu, Fengyun Rao +2
2021-10-14
计算机视觉与模式识别 · 计算机科学
端到端的终结:一项视频理解五项全能挑战(2020)
Samuel Albanie, Yang Liu, Arsha Nagrani, Antoine Miech +17
2020-08-04
计算机视觉与模式识别 · 计算机科学
ActivityNet 挑战赛 2017 总结
Bernard Ghanem, Juan Carlos Niebles, Cees Snoek, Fabian Caba Heilbron +5
2017-10-24
计算机视觉与模式识别 · 计算机科学
综述:基于 Transformer 的视频-语言预训练
Ludan Ruan, Qin Jin
2021-09-22
计算与语言 · 计算机科学
结合视频与蕴含生成的多任务视频字幕生成
Ramakanth Pasunuru, Mohit Bansal
2017-08-09
计算机视觉与模式识别 · 计算机科学
视频摘要综述
Mayu Otani, Yale Song, Yang Wang
2022-10-24
计算机视觉与模式识别 · 计算机科学
端到端密集视频描述生成作为序列生成
Wanrong Zhu, Bo Pang, Ashish V. Thapliyal, William Yang Wang +1
2022-09-19
人工智能 · 计算机科学
视频摘要是否需要视频?量化语言在视频摘要中的有效性
Yoonsoo Nam, Adam Lehavi, Daniel Yang, Digbalay Bose +2
2023-09-19
计算机视觉与模式识别 · 计算机科学
生成多样且有意义的图像描述
Annika Lindh, Robert J. Ross, Abhijit Mahalunkar, Giancarlo Salton +1
2018-12-20
计算机视觉与模式识别 · 计算机科学
Perception Test 2023:首届挑战赛与结果总结
Joseph Heyward, João Carreira, Dima Damen, Andrew Zisserman +1
2023-12-21
计算机视觉与模式识别 · 计算机科学
从图像描述中学习音视频模态
Arsha Nagrani, Paul Hongsuck Seo, Bryan Seybold, Anja Hauth +3
2022-04-05
多媒体 · 计算机科学
MediaEval 2020预测媒体记忆性任务概述:什么使视频令人难忘?
Alba García Seco De Herrera, Rukiye Savran Kiziltepe, Jon Chamberlain, Mihai Gabriel Constantin +4
2021-01-01
计算机视觉与模式识别 · 计算机科学
视频摘要:多种技术的研究
Ravi Raj, Varad Bhatnagar, Aman Kumar Singh, Sneha Mane +1
2021-01-22
计算机视觉与模式识别 · 计算机科学
基于分层强化学习的视频字幕生成
Xin Wang, Wenhu Chen, Jiawei Wu, Yuan-Fang Wang +1
2018-03-30
计算机视觉与模式识别 · 计算机科学
用于密集视频描述的多模态预训练
Gabriel Huang, Bo Pang, Zhenhai Zhu, Clara Rivera +1
2020-11-25