VectorEdits:面向指令驱动矢量图编辑的数据集与基准
机器学习
2025-06-23 v1
摘要
我们介绍了一个大型数据集,用于指令导引的矢量图像编辑,包含超过 27 万对由自然语言编辑指令配对的 SVG 图像。该数据集支持基于文本命令修改矢量图形的模型训练和评估。我们描述了数据收集过程,包括通过 CLIP 相似度进行图像配对和使用视觉语言模型生成指令。初始实验表明,当前方法在生成准确且有效的编辑方面存在挑战,凸显了这一任务的难度。为促进自然语言驱动的矢量图形生成和编辑研究,我们将本工作中创建的资源公开提供。
引用
@article{arxiv.2506.15903,
title = {VectorEdits: A Dataset and Benchmark for Instruction-Based Editing of Vector Graphics},
author = {Josef Kuchař and Marek Kadlčík and Michal Spiegel and Michal Štefánik},
journal= {arXiv preprint arXiv:2506.15903},
year = {2025}
}