面向人类的 DreamBench++:用于个性化图像生成的人类对齐基准
计算机视觉与模式识别
2025-03-11 v2
摘要
个性化图像生成因其在各种情境下创造性地生成个性化内容的强大能力,正在为人类的日常工作和生活提供巨大的帮助。然而,现有的评估要么是自动化的但与人类不对齐,要么需要耗时且昂贵的人类评估。本文提出 DreamBench++,一个由先进的多模态 GPT 模型自动化的人类对齐基准。具体地,我们系统地设计提示词,使 GPT 既能实现人类对齐,又能实现自我对齐,并通过任务强化获得力量。进一步地,我们构建了一个包含多样化图像和提示词的全面数据集。通过对 7 个现代生成模型进行基准测试,我们展示,DreamBench++ 能显著提升人类对齐评估,帮助社区发现创新成果。
引用
@article{arxiv.2406.16855,
title = {DreamBench++: A Human-Aligned Benchmark for Personalized Image Generation},
author = {Yuang Peng and Yuxin Cui and Haomiao Tang and Zekun Qi and Runpei Dong and Jing Bai and Chunrui Han and Zheng Ge and Xiangyu Zhang and Shu-Tao Xia},
journal= {arXiv preprint arXiv:2406.16855},
year = {2025}
}
备注
ICLR 2025, Project page: https://dreambenchplus.github.io/