中文

JEPA 用于 RL:探究联合嵌入预测架构用于强化学习

计算机视觉与模式识别 2025-04-24 v1

摘要

联合嵌入预测架构(JEPA)最近日益流行,作为自监督学习的有前景的架构。视觉变换器使用 JEPA 进行训练,可从图像和视频中产生嵌入,已显示出高度适合分类和分割等下游任务。本文展示了如何将 JEPA 架构适用于图像强化学习。我们讨论了模型崩溃问题,说明如何防止其发生,并提供了经典 Cart Pole 任务上的示例数据。

关键词

引用

@article{arxiv.2504.16591,
  title  = {JEPA for RL: Investigating Joint-Embedding Predictive Architectures for Reinforcement Learning},
  author = {Tristan Kenneweg and Philip Kenneweg and Barbara Hammer},
  journal= {arXiv preprint arXiv:2504.16591},
  year   = {2025}
}

备注

Published at ESANN 2025