一种用于选择 D2D 移动中继的动态激励策略
信息论
2020-10-26 v2 math.IT
摘要
通过设备到设备通信(D2D)实现的用户到网络中继是一项有望提升蜂窝网络性能的技术。由于实际中中继处于移动状态,动态中继选择方案不可避免。本文提出一种动态中继选择策略,在成本约束(如传输功率、功率预算)下最大化蜂窝网络的性能(如吞吐量、可靠性、覆盖)。我们将中继的动态性建模为马尔可夫决策过程(MDP),并假设仅能观测到被选中继的位置。因此,动态中继选择过程被建模为约束部分可观测马尔可夫决策过程(CPOMDP)。由于该框架的精确解难以求解,我们开发了基于点的价值迭代解法并评估其性能。此外,我们证明了奖励与成本价值函数的子模性,并推导出一种随被发现中继数量可扩展的贪心解。针对多用户场景,引入了一种分布式方法以降低所提方案的复杂度和开销。我们给出了在能量约束下最大化吞吐量的场景数值结果,并评估了所提中继选择策略相较于传统蜂窝网络所获得的增益。
引用
@article{arxiv.1905.02392,
title = {A Dynamic and Incentive Policy for Selecting D2D Mobile Relays},
author = {Rita Ibrahim and Mohamad Assaad and Berna Sayrac},
journal= {arXiv preprint arXiv:1905.02392},
year = {2020}
}