基于内容感知布局推断的美学文字标志合成
计算机视觉与模式识别
2022-04-07 v1
摘要
文字标志设计高度依赖专业设计师的创造力与专业知识,其中元素布局的排布是最关键的环节之一。然而,这一需要考虑诸多因素(如字体、语言学、主题等)的任务却鲜受关注。本文提出一种内容感知布局生成网络,以字形图像及其对应文本为输入,自动合成美观的布局。具体而言,我们设计了一个双判别器模块,包括序列判别器和图像判别器,分别评估合成文字标志的字符放置轨迹与渲染形状。此外,我们融合来自文本的语言学信息与来自字形的视觉语义以引导布局预测,二者在专业布局设计中均起重要作用。为训练与评估我们的方法,我们构建了名为TextLogo3K的数据集,包含约3500张文字标志图像及其像素级标注。在该数据集上的实验研究证明了我们的方法在合成视觉愉悦文字标志上的有效性,并验证了其对SOTA方法的优越性。
引用
@article{arxiv.2204.02701,
title = {Aesthetic Text Logo Synthesis via Content-aware Layout Inferring},
author = {Yizhi Wang and Guo Pu and Wenhan Luo and Yexin Wang and Pengfei Xiong and Hongwen Kang and Zhouhui Lian},
journal= {arXiv preprint arXiv:2204.02701},
year = {2022}
}
备注
Accepted by CVPR 2022. Code and Dataset: https://github.com/yizhiwang96/TextLogoLayout