面向特定字体的中文书法生成的基于扩散模型——Moyun
计算机视觉与模式识别
2025-12-09 v2 人工智能
摘要
尽管中文书法生成已经实现了风格迁移,但通过指定书法家、字体和字符样式来生成书法仍具有挑战性。为此,我们提出了新的中文书法生成模型'Moyun',将扩散模型中的Unet替换为Vision Mamba,并引入TripleLabel控制机制以实现可控书法生成。该模型在我们拥有超过190万张图片的大型数据集'Mobao'上进行测试,结果表明'Moyun'能够有效控制生成过程并生成符合指定风格的书法。即使对于书法家尚未书写的字体,'Moyun'也能生成符合书法家风格的书法。
引用
@article{arxiv.2410.07618,
title = {Moyun: A Diffusion-Based Model for Style-Specific Chinese Calligraphy Generation},
author = {Kaiyuan Liu and Jiahao Mei and Hengyu Zhang and Yihuai Zhang and Daoguo Dong and Liang He},
journal= {arXiv preprint arXiv:2410.07618},
year = {2025}
}