盲人在可教对象识别器中访问其训练图像
人机交互
2022-10-17 v2 计算机视觉与模式识别
摘要
机器学习模型的训练与评估迭代是提升其性能的重要过程。然而,尽管可教界面使盲用户能够用其特定环境中拍摄的照片训练和测试对象识别器,训练迭代与评估步骤的可访问性却很少受到关注。迭代需要对训练照片进行视觉检查,而这对盲用户是不可及的。我们通过 MyCam 这一移动应用探讨这一挑战,该应用结合自动估计的描述符,以非视觉方式访问用户训练集中的照片。我们通过在其家中进行的评估研究,探讨盲参与者(N=12)如何与 MyCam 及描述符交互。我们证明,实时的照片级描述符使盲用户能够减少包含被裁剪对象的照片,并且参与者可通过迭代访问其训练集质量来增加更多变化。此外,参与者认为该应用简单易用,表明他们能有效训练它且描述符有用。然而,主观反馈未反映在其模型性能中,部分由于训练变化少且背景杂乱。
引用
@article{arxiv.2208.07968,
title = {Blind Users Accessing Their Training Images in Teachable Object Recognizers},
author = {Jonggi Hong and Jaina Gandhi and Ernest Essuah Mensah and Farnaz Zamiri Zeraati and Ebrima Haddy Jarjue and Kyungjun Lee and Hernisa Kacorri},
journal= {arXiv preprint arXiv:2208.07968},
year = {2022}
}