Computation and Language · Computer Science
Bird-Eye Transformers for Text Generation Models
Lei Sha, Yuhang Song, Yordan Yordanov, Tommaso Salvatori +1
2022-10-11
Computer Vision and Pattern Recognition · Computer Science
TREAD: Token Routing for Efficient Architecture-agnostic Diffusion Training
Felix Krause, Timy Phan, Ming Gui, Stefan Andreas Baumann +2
2025-10-14
Computer Vision and Pattern Recognition · Computer Science
Discriminative Class Tokens for Text-to-Image Diffusion Models
Idan Schwartz, Vésteinn Snæbjarnarson, Hila Chefer, Ryan Cotterell +3
2025-01-13
Computer Vision and Pattern Recognition · Computer Science
Discrete Representations Strengthen Vision Transformer Robustness
Chengzhi Mao, Lu Jiang, Mostafa Dehghani, Carl Vondrick +2
2022-04-05
Computer Vision and Pattern Recognition · Computer Science
Towards the Unseen: Iterative Text Recognition by Distilling from Errors
Ayan Kumar Bhunia, Pinaki Nath Chowdhury, Aneeshan Sain, Yi-Zhe Song
2021-07-27
Computer Vision and Pattern Recognition · Computer Science
Enhancing Diffusion Models with Text-Encoder Reinforcement Learning
Chaofeng Chen, Annan Wang, Haoning Wu, Liang Liao +3
2024-07-18
Computer Vision and Pattern Recognition · Computer Science
AttnDreamBooth: Towards Text-Aligned Personalized Text-to-Image Generation
Lianyu Pang, Jian Yin, Baoquan Zhao, Feize Wu +3
2024-06-10
Computer Vision and Pattern Recognition · Computer Science
Powerful and Flexible: Personalized Text-to-Image Generation via Reinforcement Learning
Fanyue Wei, Wei Zeng, Zhenyang Li, Dawei Yin +2
2024-07-19
Computer Vision and Pattern Recognition · Computer Science
Discrete Noise Inversion for Next-scale Autoregressive Text-based Image Editing
Quan Dao, Xiaoxiao He, Ligong Han, Ngan Hoai Nguyen +5
2025-09-04
Artificial Intelligence · Computer Science
Rare Text Semantics Were Always There in Your Diffusion Transformer
Seil Kang, Woojung Han, Dayun Ju, Seong Jae Hwang
2025-10-07
Artificial Intelligence · Computer Science
Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model
Chunting Zhou, Lili Yu, Arun Babu, Kushal Tirumala +6
2024-08-21
Computer Vision and Pattern Recognition · Computer Science
Fine-tuning Image Transformers using Learnable Memory
Mark Sandler, Andrey Zhmoginov, Max Vladymyrov, Andrew Jackson
2022-03-31
Graphics · Computer Science
Tight Inversion: Image-Conditioned Inversion for Real Image Editing
Edo Kadosh, Nir Goren, Or Patashnik, Daniel Garibi +1
2025-02-28
Computer Vision and Pattern Recognition · Computer Science
BARET : Balanced Attention based Real image Editing driven by Target-text Inversion
Yuming Qiao, Fanyi Wang, Jingwen Su, Yanhao Zhang +3
2023-12-12
Computer Vision and Pattern Recognition · Computer Science
On Improving Adversarial Transferability of Vision Transformers
Muzammal Naseer, Kanchana Ranasinghe, Salman Khan, Fahad Shahbaz Khan +1
2022-03-04
Computer Vision and Pattern Recognition · Computer Science
EditTransfer++: Toward Faithful and Efficient Visual-Prompt-Guided Image Editing
Lan Chen, Qi Mao, Yiren Song, Yuchao Gu +1
2026-05-11