VTBench:面向真实世界虚拟试穿模型的综合基准测试套件
计算机视觉与模式识别
2025-05-27 v1
摘要
尽管虚拟试穿取得了显著进展,但在真实世界场景下评估这些模型仍是一项挑战。一个综合基准测试至关重要,原因有三:(1)当前的指标未能充分反映人类感知,特别是在未配对的试穿设置中;(2)现有大多数测试集局限于室内场景,缺乏真实世界评估所需的复杂性;(3)理想的系统应能指导虚拟试穿生成的未来发展方向。为满足这些需求,我们引入了 VTBench,这是一个分层基准测试套件,将虚拟图像试穿系统地分解为分层、解耦的维度,每个维度都配备了定制的测试集和评估标准。VTBench 展现出三个关键优势:1)多维评估框架:该基准涵盖了虚拟试穿生成的五个关键维度(例如,整体图像质量、纹理保留、复杂背景一致性、跨类别尺寸适应性以及手部遮挡处理)。相应测试集的细粒度评估指标精确定位了模型在多样且具挑战性的场景中的能力与局限。2)人类对齐:为每个测试集提供了人类偏好标注,确保基准在所有评估维度上与感知质量对齐。(3)有价值的见解:除了标准室内设置外,我们分析了模型在各维度上的性能变化,并调查了室内与真实世界试穿场景之间的差异。为推动虚拟试穿领域向具挑战性的真实世界场景发展,VTBench 将开源,包括所有测试集、评估协议、生成结果和人类标注。
引用
@article{arxiv.2505.19571,
title = {VTBench: Comprehensive Benchmark Suite Towards Real-World Virtual Try-on Models},
author = {Hu Xiaobin and Liang Yujie and Luo Donghao and Peng Xu and Zhang Jiangning and Zhu Junwei and Wang Chengjie and Fu Yanwei},
journal= {arXiv preprint arXiv:2505.19571},
year = {2025}
}
备注
Project Websit: \url{https://github.com/HUuxiaobin/VTBench}