隐私保护视觉问答
计算机视觉与模式识别
2022-02-17 v1
摘要
我们介绍了一种在边缘设备上执行视觉问答(VQA)的新颖隐私保护方法。我们的方法使用低复杂度计算机视觉模型联合预测类别、属性和谓词,从而构建视觉场景的符号表示。该符号表示是不可微的,这意味着它不能用于恢复原始图像,从而保持原始图像的隐私。我们提出的混合方案使用的视觉模型比当前最先进(SOTA)视觉模型小 25 倍以上,比端到端 SOTA VQA 模型小 100 倍。我们报告了详细的误差分析,并讨论了使用蒸馏视觉模型和视觉场景符号表示之间的权衡。
引用
@article{arxiv.2202.07712,
title = {Privacy Preserving Visual Question Answering},
author = {Cristian-Paul Bara and Qing Ping and Abhinav Mathur and Govind Thattai and Rohith MV and Gaurav S. Sukhatme},
journal= {arXiv preprint arXiv:2202.07712},
year = {2022}
}