Computer Vision and Pattern Recognition · Computer Science
Prompt Reinjection: Alleviating Prompt Forgetting in Multimodal Diffusion Transformers
Yuxuan Yao, Yuxuan Chen, Hui Li, Kaihui Cheng +5
2026-05-21
Artificial Intelligence · Computer Science
Rare Text Semantics Were Always There in Your Diffusion Transformer
Seil Kang, Woojung Han, Dayun Ju, Seong Jae Hwang
2025-10-07
Computer Vision and Pattern Recognition · Computer Science
Enhancing MMDiT-Based Text-to-Image Models for Similar Subject Generation
Tianyi Wei, Dongdong Chen, Yifan Zhou, Xingang Pan
2024-11-28
Computer Vision and Pattern Recognition · Computer Science
ConceptAttention: Diffusion Transformers Learn Highly Interpretable Features
Alec Helbling, Tuna Han Salih Meral, Ben Hoover, Pinar Yanardag +1
2025-07-03
Computer Vision and Pattern Recognition · Computer Science
TextGuider: Training-Free Guidance for Text Rendering via Attention Alignment
Kanghyun Baek, Sangyub Lee, Jin Young Choi, Jaewoo Song +5
2025-12-16
Computer Vision and Pattern Recognition · Computer Science
Dual Diffusion for Unified Image Generation and Understanding
Zijie Li, Henry Li, Yichun Shi, Amir Barati Farimani +3
2025-04-03
Computer Vision and Pattern Recognition · Computer Science
Delta-K: Boosting Multi-Instance Generation via Cross-Attention Augmentation
Zitong Wang, Zijun Shen, Haohao Xu, Zhengjie Luo +1
2026-03-12
Computer Vision and Pattern Recognition · Computer Science
EDiT: Efficient Diffusion Transformers with Linear Compressed Attention
Philipp Becker, Abhinav Mehrotra, Ruchika Chavhan, Malcolm Chadwick +4
2025-08-12
Computer Vision and Pattern Recognition · Computer Science
Multi-Concept T2I-Zero: Tweaking Only The Text Embeddings and Nothing Else
Hazarapet Tunanyan, Dejia Xu, Shant Navasardyan, Zhangyang Wang +1
2023-10-12
Computer Vision and Pattern Recognition · Computer Science
Unraveling MMDiT Blocks: Training-free Analysis and Enhancement of Text-conditioned Diffusion
Binglei Li, Mengping Yang, Zhiyu Tan, Junping Zhang +1
2026-01-06
Computer Vision and Pattern Recognition · Computer Science
Seg4Diff: Unveiling Open-Vocabulary Segmentation in Text-to-Image Diffusion Transformers
Chaehyun Kim, Heeseong Shin, Eunbeen Hong, Heeji Yoon +4
2025-09-23
Computer Vision and Pattern Recognition · Computer Science
Exploring Multimodal Diffusion Transformers for Enhanced Prompt-based Image Editing
Joonghyuk Shin, Alchan Hwang, Yujin Kim, Daneul Kim +1
2025-08-12
Computer Vision and Pattern Recognition · Computer Science
How to Continually Adapt Text-to-Image Diffusion Models for Flexible Customization?
Jiahua Dong, Wenqi Liang, Hongliu Li, Duzhen Zhang +4
2024-10-24
Computer Vision and Pattern Recognition · Computer Science
Latent Space Disentanglement in Diffusion Transformers Enables Zero-shot Fine-grained Semantic Editing
Zitao Shuai, Chenwei Wu, Zhengxu Tang, Bowen Song +1
2024-08-27
Computer Vision and Pattern Recognition · Computer Science
OSIC: A New One-Stage Image Captioner Coined
Bo Wang, Zhao Zhang, Mingbo Zhao, Xiaojie Jin +2
2022-11-07
Computer Vision and Pattern Recognition · Computer Science
EDITOR: Effective and Interpretable Prompt Inversion for Text-to-Image Diffusion Models
Mingzhe Li, Kejing Xia, Gehao Zhang, Zhenting Wang +4
2026-03-06
Computer Vision and Pattern Recognition · Computer Science
Orthogonal Negative Guidance in Attention Feature Space for Text-to-Image Generation
Jungmin Ko, Jungwon Park, Jimyeong Kim, Changin Choi +2
2026-05-29
Computer Vision and Pattern Recognition · Computer Science
Enhancing Text-to-Image Diffusion Transformer via Split-Text Conditioning
Yu Zhang, Jialei Zhou, Xinchen Li, Qi Zhang +5
2026-04-15
Computer Vision and Pattern Recognition · Computer Science
TIDE: Text-Informed Dynamic Extrapolation with Step-Aware Temperature Control for Diffusion Transformers
Yihua Liu, Fanjiang Ye, Bowen Lin, Rongyu Fang +1
2026-03-11
Computer Vision and Pattern Recognition · Computer Science
Uncovering the Text Embedding in Text-to-Image Diffusion Models
Hu Yu, Hao Luo, Fan Wang, Feng Zhao
2024-04-02
Computer Vision and Pattern Recognition · Computer Science
Concept Corrector: Erase concepts on the fly for text-to-image diffusion models
Zheling Meng, Bo Peng, Xiaochuan Jin, Yueming Lyu +3
2025-06-04