中文

盲人行走:基于文本的盲人运动建模

计算机视觉与模式识别 2025-12-23 v2

摘要

盲人 perceive the world 与拥有视力者不同,这会导致运动特征的差异。例如,在十字路口,盲人可能的运动模式包括偏离直线路径或围绕路缘和障碍物进行触觉探索。这些行为对内嵌于自动驾驶技术中的运动模型而言可能显得不够可预测。然而,3D人体运动模型捕捉此类行为的能力尚未被研究,因为现有3D人体运动数据集缺乏多样性,偏向于拥有视力者。本文引入BlindWays,首个针对盲人行人的数据基准。我们使用佩戴式传感器收集11名盲人在真实城市环境中穿越8条不同路线的3D运动数据。此外,我们提供丰富的文本描述,捕捉盲人行人独特的运动特征及其与导航辅助工具(如白杖或导盲犬)和环境之间的互动。我们对标注了SOTA的3D人体预测模型进行基准测试,发现现有方法在本新任务中表现不佳。为构建能无缝推理环境中多样化人类运动的更安全可靠系统,我们的文本与运动基准已公开于https://blindways.github.io。

关键词

引用

@article{arxiv.2412.05277,
  title  = {Text to Blind Motion},
  author = {Hee Jae Kim and Kathakoli Sengupta and Masaki Kuribayashi and Hernisa Kacorri and Eshed Ohn-Bar},
  journal= {arXiv preprint arXiv:2412.05277},
  year   = {2025}
}

备注

Accepted at NeurIPS 2024