Computer Vision and Pattern Recognition · Computer Science
TokenVerse: Versatile Multi-concept Personalization in Token Modulation Space
Daniel Garibi, Shahar Yadin, Roni Paiss, Omer Tov +5
2025-01-22
Computer Vision and Pattern Recognition · Computer Science
Continuous, Subject-Specific Attribute Control in T2I Models by Identifying Semantic Directions
Stefan Andreas Baumann, Felix Krause, Michael Neumayr, Nick Stracke +3
2025-03-17
Computer Vision and Pattern Recognition · Computer Science
DreamBooth: Fine Tuning Text-to-Image Diffusion Models for Subject-Driven Generation
Nataniel Ruiz, Yuanzhen Li, Varun Jampani, Yael Pritch +2
2023-03-16
Computer Vision and Pattern Recognition · Computer Science
Customizing Text-to-Image Diffusion with Object Viewpoint Control
Nupur Kumari, Grace Su, Richard Zhang, Taesung Park +2
2024-12-04
Computer Vision and Pattern Recognition · Computer Science
Towards a Simultaneous and Granular Identity-Expression Control in Personalized Face Generation
Renshuai Liu, Bowen Ma, Wei Zhang, Zhipeng Hu +4
2024-04-09
Computer Vision and Pattern Recognition · Computer Science
ControlStyle: Text-Driven Stylized Image Generation Using Diffusion Priors
Jingwen Chen, Yingwei Pan, Ting Yao, Tao Mei
2023-11-10
Computer Vision and Pattern Recognition · Computer Science
Personalize Anything for Free with Diffusion Transformer
Haoran Feng, Zehuan Huang, Lin Li, Hairong Lv +1
2025-03-18
Computer Vision and Pattern Recognition · Computer Science
MS-Diffusion: Multi-subject Zero-shot Image Personalization with Layout Guidance
Xierui Wang, Siming Fu, Qihan Huang, Wanggui He +1
2025-03-05
Computer Vision and Pattern Recognition · Computer Science
ComposeMe: Attribute-Specific Image Prompts for Controllable Human Image Generation
Guocheng Gordon Qian, Daniil Ostashev, Egor Nemchinov, Avihay Assouline +3
2025-10-17
Computer Vision and Pattern Recognition · Computer Science
DreamTuner: Single Image is Enough for Subject-Driven Generation
Miao Hua, Jiawei Liu, Fei Ding, Wei Liu +2
2023-12-22
Computer Vision and Pattern Recognition · Computer Science
VideoDreamer: Customized Multi-Subject Text-to-Video Generation with Disen-Mix Finetuning on Language-Video Foundation Models
Hong Chen, Xin Wang, Guanning Zeng, Yipeng Zhang +4
2025-04-15
Computer Vision and Pattern Recognition · Computer Science
BLIP-Diffusion: Pre-trained Subject Representation for Controllable Text-to-Image Generation and Editing
Dongxu Li, Junnan Li, Steven C. H. Hoi
2023-06-23
Computer Vision and Pattern Recognition · Computer Science
Canvas-to-Image: Compositional Image Generation with Multimodal Controls
Yusuf Dalva, Guocheng Gordon Qian, Maya Goldenberg, Tsai-Shien Chen +4
2025-11-27
Computer Vision and Pattern Recognition · Computer Science
Textual Localization: Decomposing Multi-concept Images for Subject-Driven Text-to-Image Generation
Junjie Shentu, Matthew Watson, Noura Al Moubayed
2024-02-16
Computer Vision and Pattern Recognition · Computer Science
Compass Control: Multi Object Orientation Control for Text-to-Image Generation
Rishubh Parihar, Vaibhav Agrawal, Sachidanand VS, R. Venkatesh Babu
2025-04-11
Computer Vision and Pattern Recognition · Computer Science
Towards Unified Semantic and Controllable Image Fusion: A Diffusion Transformer Approach
Jiayang Li, Chengjie Jiang, Junjun Jiang, Pengwei Liang +2
2025-12-09
Computer Vision and Pattern Recognition · Computer Science
OminiControl: Minimal and Universal Control for Diffusion Transformer
Zhenxiong Tan, Songhua Liu, Xingyi Yang, Qiaochu Xue +1
2025-07-08
Computer Vision and Pattern Recognition · Computer Science
CustomText: Customized Textual Image Generation using Diffusion Models
Shubham Paliwal, Arushi Jain, Monika Sharma, Vikram Jamwal +1
2024-05-22
Computer Vision and Pattern Recognition · Computer Science
Att-Adapter: A Robust and Precise Domain-Specific Multi-Attributes T2I Diffusion Adapter via Conditional Variational Autoencoder
Wonwoong Cho, Yan-Ying Chen, Matthew Klenk, David I. Inouye +1
2025-07-25
Computer Vision and Pattern Recognition · Computer Science
Squeezing Capacity from Multimodal Large Language Models for Subject-driven Generation
Shuhong Zheng, Aashish Kumar Misraa, Yu-Teng Li, Yu-Jhe Li +1
2026-05-26
Computer Vision and Pattern Recognition · Computer Science
Be Yourself: Bounded Attention for Multi-Subject Text-to-Image Generation
Omer Dahary, Or Patashnik, Kfir Aberman, Daniel Cohen-Or
2024-03-26
Computer Vision and Pattern Recognition · Computer Science
DisenStudio: Customized Multi-subject Text-to-Video Generation with Disentangled Spatial Control
Hong Chen, Xin Wang, Yipeng Zhang, Yuwei Zhou +3
2024-05-22
Computer Vision and Pattern Recognition · Computer Science
DiffUTE: Universal Text Editing Diffusion Model
Haoxing Chen, Zhuoer Xu, Zhangxuan Gu, Jun Lan +5
2023-10-19