使用多模态深度学习提取与概括视频显式内容
计算机视觉与模式识别
2023-11-22 v2 计算与语言
机器学习
摘要
随着互联网上视频分享平台的增多,人工审核数据中的显式内容变得困难。因此,自动扫描视频数据以检测显式内容的流水线已成为当务之急。我们提出了一种新颖的流水线,它使用多模态深度学习首先提取输入视频的显式片段,然后利用文本概括其内容以确定其年龄适宜性与年龄分级。我们最后使用标准指标评估了该流水线的有效性。
引用
@article{arxiv.2311.10899,
title = {Extraction and Summarization of Explicit Video Content using Multi-Modal Deep Learning},
author = {Shaunak Joshi and Raghav Gaggar},
journal= {arXiv preprint arXiv:2311.10899},
year = {2023}
}
备注
8 pages, 3 figures