中文

预测视频记忆性的多模态集成模型

机器学习 2021-02-03 v1 人工智能 多媒体

摘要

对媒体记忆性建模一直是机器学习领域的持续挑战。MediaEval2020 中的预测媒体记忆性任务是针对该主题的最新同类基准。基于该挑战前几届迭代中开发的技术,我们利用提取的视频、图像、文本和音频特征开发了集成方法。关键的是,在本工作中我们引入并展示了所提取音频嵌入作为预测媒体记忆性任务特征的有效性与高泛化能力。

关键词

引用

@article{arxiv.2102.01173,
  title  = {Multi-modal Ensemble Models for Predicting Video Memorability},
  author = {Tony Zhao and Irving Fang and Jeffrey Kim and Gerald Friedland},
  journal= {arXiv preprint arXiv:2102.01173},
  year   = {2021}
}