Improvements to SDXL in NovelAI Diffusion V3
Computer Vision and Pattern Recognition
2024-09-30 v2 Artificial Intelligence
Machine Learning
Abstract
In this technical report, we document the changes we made to SDXL in the process of training NovelAI Diffusion V3, our state of the art anime image generation model.
Cite
@article{arxiv.2409.15997,
title = {Improvements to SDXL in NovelAI Diffusion V3},
author = {Juan Ossa and Eren Doğan and Alex Birch and F. Johnson},
journal= {arXiv preprint arXiv:2409.15997},
year = {2024}
}
Comments
14 pages, 8 figures
Related papers
View all related →
Computer Vision and Pattern Recognition · Computer Science
SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis
Dustin Podell, Zion English, Kyle Lacey, Andreas Blattmann +4
2023-07-06
Computer Vision and Pattern Recognition · Computer Science
SDXL-Lightning: Progressive Adversarial Diffusion Distillation
Shanchuan Lin, Anran Wang, Xiao Yang
2024-03-05
Computer Vision and Pattern Recognition · Computer Science
Improving Text Generation on Images with Synthetic Captions
Jun Young Koh, Sang Hyun Park, Joy Song
2024-10-24
Computer Vision and Pattern Recognition · Computer Science
Deep Reward Supervisions for Tuning Text-to-Image Diffusion Models
Xiaoshi Wu, Yiming Hao, Manyuan Zhang, Keqiang Sun +4
2024-05-03
Computer Vision and Pattern Recognition · Computer Science
Progressive Knowledge Distillation Of Stable Diffusion XL Using Layer Level Loss
Yatharth Gupta, Vishnu V. Jaddipal, Harish Prabhala, Sayak Paul +1
2024-01-08
Computer Vision and Pattern Recognition · Computer Science
SDXS: Real-Time One-Step Latent Diffusion Models with Image Conditions
Yuda Song, Zehao Sun, Xuanwu Yin
2024-04-18
Computer Vision and Pattern Recognition · Computer Science
IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation
Amritanshu Tiwari, Cherish Puniani, Kaustubh Sharma, Ojasva Nema
2025-05-19
Computer Vision and Pattern Recognition · Computer Science
KOALA: Empirical Lessons Toward Memory-Efficient and Fast Diffusion Models for Text-to-Image Synthesis
Youngwan Lee, Kwanyong Park, Yoorhim Cho, Yong-Ju Lee +1
2024-11-26
Computation and Language · Computer Science
XDLM: Cross-lingual Diffusion Language Model for Machine Translation
Linyao Chen, Aosong Feng, Boming Yang, Zihui Li
2023-08-01
Machine Learning · Computer Science
Self-Play Fine-Tuning of Diffusion Models for Text-to-Image Generation
Huizhuo Yuan, Zixiang Chen, Kaixuan Ji, Quanquan Gu
2024-02-16
Computer Vision and Pattern Recognition · Computer Science
SeedEdit 3.0: Fast and High-Quality Generative Image Editing
Peng Wang, Yichun Shi, Xiaochen Lian, Zhonghua Zhai +4
2025-06-09
Computer Vision and Pattern Recognition · Computer Science
Fine-Tuning Stable Diffusion XL for Stylistic Icon Generation: A Comparison of Caption Size
Youssef Sultan, Jiangqin Ma, Yu-Ying Liao
2024-07-16
Computation and Language · Computer Science
Taiyi-Diffusion-XL: Advancing Bilingual Text-to-Image Generation with Large Vision-Language Model Support
Xiaojun Wu, Dixiang Zhang, Ruyi Gan, Junyu Lu +5
2024-06-19
Computer Vision and Pattern Recognition · Computer Science
MaskAttn-SDXL: Controllable Region-Level Text-To-Image Generation
Yu Chang, Jiahao Chen, Anzhe Cheng, Paul Bogdan
2026-05-19
Computer Vision and Pattern Recognition · Computer Science
Playground v2.5: Three Insights towards Enhancing Aesthetic Quality in Text-to-Image Generation
Daiqing Li, Aleks Kamko, Ehsan Akhgari, Ali Sabet +2
2024-02-28
Computer Vision and Pattern Recognition · Computer Science
CoMat: Aligning Text-to-Image Diffusion Model with Image-to-Text Concept Matching
Dongzhi Jiang, Guanglu Song, Xiaoshi Wu, Renrui Zhang +4
2024-11-28
Computer Vision and Pattern Recognition · Computer Science
CogView3: Finer and Faster Text-to-Image Generation via Relay Diffusion
Wendi Zheng, Jiayan Teng, Zhuoyi Yang, Weihan Wang +5
2024-03-11
Computer Vision and Pattern Recognition · Computer Science
AnimeAdapter: Fine-grained and Consistent Zero-shot Anime Character Generation
Yixuan Han
2026-05-21
Computer Vision and Pattern Recognition · Computer Science
DragonDiffusion: Enabling Drag-style Manipulation on Diffusion Models
Chong Mou, Xintao Wang, Jiechong Song, Ying Shan +1
2023-11-21
Computer Vision and Pattern Recognition · Computer Science
Self-correcting LLM-controlled Diffusion Models
Tsung-Han Wu, Long Lian, Joseph E. Gonzalez, Boyi Li +1
2023-11-28
Computer Vision and Pattern Recognition · Computer Science
SDDM: Score-Decomposed Diffusion Models on Manifolds for Unpaired Image-to-Image Translation
Shikun Sun, Longhui Wei, Junliang Xing, Jia Jia +1
2023-08-07
Computer Vision and Pattern Recognition · Computer Science
TriLoRA: Integrating SVD for Advanced Style Personalization in Text-to-Image Generation
Chengcheng Feng, Mu He, Qiuyu Tian, Haojie Yin +3
2024-06-14
Machine Learning · Computer Science
Straight-Line Diffusion Model for Efficient 3D Molecular Generation
Yuyan Ni, Shikun Feng, Haohan Chi, Bowen Zheng +4
2025-06-10
Machine Learning · Computer Science
A Survey on Pre-Trained Diffusion Model Distillations
Xuhui Fan, Zhangkai Wu, Hongyu Wu
2025-08-18
Computer Vision and Pattern Recognition · Computer Science
SV3D: Novel Multi-view Synthesis and 3D Generation from a Single Image using Latent Video Diffusion
Vikram Voleti, Chun-Han Yao, Mark Boss, Adam Letts +5
2024-03-19