中文

速率分割多址接入赋能的自适应全景视频语义传输

图像与视频处理 2024-06-25 v2

摘要

本文提出了一种由速率分割多址接入 (RSMA) 赋能的自适应全景视频语义传输 (APVST) 框架。APVST 框架包含语义发射机和接收机,利用深度联合信源信道编码结构自适应地从全景帧中提取和编码语义特征。为了实现更高的频谱效率并节省带宽,APVST 采用熵模型和维度自适应模块来控制传输速率。此外,我们将加权球面均匀峰值信噪比 (WS-PSNR) 和加权球面均匀结构相似性 (WS-SSIM) 作为全景视频的失真评估指标,并为 APVST 设计了加权自注意力模块。该模块整合权重和特征图以提升沉浸式体验质量。考虑到用户观看全景视频时视野的重叠,我们进一步利用 RSMA 将所需的全景视频语义流分割为公共消息和私有消息进行传输。我们提出了一种 RSMA 赋能的语义流传输方案,并通过优化功率、公共速率和信道带宽的分配比例,构建了延迟与沉浸式体验质量的联合问题,旨在最大化用户的服务质量 (QoS) 得分。为解决上述问题,我们提出了一种基于近端策略优化 (PPO) 的高效深度强化学习算法,以应对动态变化的环境。仿真结果表明,与其他语义和传统视频传输方案相比,我们提出的 APVST 框架分别节省了高达 20% 和 50% 的信道带宽。此外,我们的研究证实了 RSMA 在全景视频传输中的效率,与 NOMA 和 OFDMA 相比,性能分别提升了 13% 和 20%。

关键词

引用

@article{arxiv.2402.16581,
  title  = {Rate Splitting Multiple Access-Enabled Adaptive Panoramic Video Semantic Transmission},
  author = {Haixiao Gao and Mengying Sun and Xiaodong Xu and Shujun Han and Bizhu Wang and Jingxuan Zhang and Ping Zhang},
  journal= {arXiv preprint arXiv:2402.16581},
  year   = {2024}
}