基于多轮区域优化的场景速绘 MROSS
计算机视觉与模式识别
2025-04-16 v2 人工智能
摘要
场景速绘是将场景转换为简化、抽象表示,以捕捉原始场景的关键元素和构图。它需要对场景进行语义理解,并考虑场景中不同区域的因素。由于场景通常包含来自不同区域的多样化视觉信息,例如前景物体、背景元素以及空间划分,处理这些不同区域具有独特的难度。本文中,我们将速绘定义为一些 B\'ezier 曲线的集合,因为它们具有光滑和通用的特征。我们在多个优化轮次中针对输入场景的不同区域进行优化。在每个优化轮次中,来自下一个区域的笔画可以无缝地集成到前一个优化轮次中生成的速绘中。我们提出了一种额外的笔画初始化方法,以确保场景的完整性和优化的收敛性。我们利用基于 CLIP 的语义损失和基于 VGG 的特征损失来指导我们的多轮优化。大量实验结果表明,我们的方法在生成速绘的质量和数量方面均显示出良好的效果。
引用
@article{arxiv.2410.04072,
title = {MROSS: Multi-Round Region-based Optimization for Scene Sketching},
author = {Yiqi Liang and Ying Liu and Dandan Long and Ruihui Li},
journal= {arXiv preprint arXiv:2410.04072},
year = {2025}
}
备注
6 pages, 8 figures