中文

EdgeVidSum:边缘端实时个性化视频摘要

计算机视觉与模式识别 2025-06-05 v1 人工智能

摘要

EdgeVidSum 是一种轻量级方法,可直接在边缘设备上生成长视频的个性化快进摘要。该方法通过使用创新的基于缩略图的技术和高效的神经架构进行本地数据处理,在实现实时视频摘要的同时保护用户隐私。与逐帧处理整个视频的传统方法不同,该方法使用缩略图容器显著降低计算复杂度,且不牺牲语义相关性。该框架采用分层分析方法,其中轻量级 2D CNN 模型从缩略图中识别用户偏好内容,并生成时间戳以创建快进摘要。我们的交互式演示突出了该系统根据个人用户偏好为电影、体育赛事和电视节目等长视频创建定制视频摘要的能力。整个计算过程在 Jetson Nano 等资源受限设备上无缝执行,展示了 EdgeVidSum 如何解决现代视频消费环境中计算效率、个性化和隐私的关键挑战。

关键词

引用

@article{arxiv.2506.03171,
  title  = {EdgeVidSum: Real-Time Personalized Video Summarization at the Edge},
  author = {Ghulam Mujtaba and Eun-Seok Ryu},
  journal= {arXiv preprint arXiv:2506.03171},
  year   = {2025}
}