中文

迈向无歧义的动作表示

计算机视觉与模式识别 2018-05-11 v1

摘要

本工作引入仅动词的动作与交互表示;即使用仅动词标签描述相似运动(如“开门”、“开橱柜”)并区分不同运动(如“开门”与“开瓶”)的问题。当前的动作识别方法忽视合理的语义模糊性与动词间的类别重叠(图 1),依赖物体来消歧交互。我们偏离单一动词标签,引入观测与多个动词标签之间的映射——以创建无歧义的动作表示。新表示受益于扩充的词汇表以及对丰富动词标签空间的软分配。我们使用双流融合 CNN 将这些表示学习为多输出回归。所提方法在三个第一人称数据集上的识别与检索均优于传统的单一动词标签(也称为多数投票)。

关键词

引用

@article{arxiv.1805.04026,
  title  = {Towards an Unequivocal Representation of Actions},
  author = {Michael Wray and Davide Moltisanti and Dima Damen},
  journal= {arXiv preprint arXiv:1805.04026},
  year   = {2018}
}