Computer Vision and Pattern Recognition · Computer Science
Re-ttention: Ultra Sparse Visual Generation via Attention Statistical Reshape
Ruichen Chen, Keith G. Mills, Liyao Jiang, Chao Gao +1
2025-10-30
Computer Vision and Pattern Recognition · Computer Science
Token Pruning for Caching Better: 9 Times Acceleration on Stable Diffusion for Free
Evelyn Zhang, Bang Xiao, Jiayi Tang, Qianli Ma +4
2025-01-03
Computer Vision and Pattern Recognition · Computer Science
Dense Text-to-Image Generation with Attention Modulation
Yunji Kim, Jiyoung Lee, Jin-Hwa Kim, Jung-Woo Ha +1
2023-08-25
Computer Vision and Pattern Recognition · Computer Science
Fast Sampling Through The Reuse Of Attention Maps In Diffusion Models
Rosco Hunter, Łukasz Dudziak, Mohamed S. Abdelfattah, Abhinav Mehrotra +2
2025-05-23
Computer Vision and Pattern Recognition · Computer Science
Enhancing Semantic Fidelity in Text-to-Image Synthesis: Attention Regulation in Diffusion Models
Yang Zhang, Teoh Tze Tzun, Lim Wei Hern, Tiviatis Sim +1
2024-03-12
Computer Vision and Pattern Recognition · Computer Science
Diffusion Autoencoders are Scalable Image Tokenizers
Yinbo Chen, Rohit Girdhar, Xiaolong Wang, Sai Saketh Rambhatla +1
2025-01-31
Machine Learning · Computer Science
ToMA: Token Merge with Attention for Diffusion Models
Wenbo Lu, Shaoyi Zheng, Yuxuan Xia, Shengjie Wang
2025-12-02
Computer Vision and Pattern Recognition · Computer Science
DiffSparse: Accelerating Diffusion Transformers with Learned Token Sparsity
Haowei Zhu, Ji Liu, Ziqiong Liu, Dong Li +3
2026-04-07
Computer Vision and Pattern Recognition · Computer Science
Making Training-Free Diffusion Segmentors Scale with the Generative Power
Benyuan Meng, Qianqian Xu, Zitai Wang, Xiaochun Cao +2
2026-03-30
Computer Vision and Pattern Recognition · Computer Science
Importance-Based Token Merging for Efficient Image and Video Generation
Haoyu Wu, Jingyi Xu, Hieu Le, Dimitris Samaras
2025-04-28
Computer Vision and Pattern Recognition · Computer Science
Training-free Diffusion Model Adaptation for Variable-Sized Text-to-Image Synthesis
Zhiyu Jin, Xuli Shen, Bin Li, Xiangyang Xue
2023-10-27
Computer Vision and Pattern Recognition · Computer Science
Discffusion: Discriminative Diffusion Models as Few-shot Vision and Language Learners
Xuehai He, Weixi Feng, Tsu-Jui Fu, Varun Jampani +5
2024-04-26
Computer Vision and Pattern Recognition · Computer Science
Token Pooling in Vision Transformers
Dmitrii Marin, Jen-Hao Rick Chang, Anurag Ranjan, Anish Prabhu +2
2023-02-28
Computer Vision and Pattern Recognition · Computer Science
DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance
Xuan Shen, Chenxia Han, Yufa Zhou, Yanyue Xie +6
2025-05-22
Computer Vision and Pattern Recognition · Computer Science
From Text to Mask: Localizing Entities Using the Attention of Text-to-Image Diffusion Models
Changming Xiao, Qi Yang, Feng Zhou, Changshui Zhang
2024-10-02
Machine Learning · Computer Science
Token Reduction Should Go Beyond Efficiency in Generative Models -- From Vision, Language to Multimodality
Zhenglun Kong, Yize Li, Fanhu Zeng, Lei Xin +6
2026-01-14
Computation and Language · Computer Science
Token Sparse Attention: Efficient Long-Context Inference with Interleaved Token Selection
Dongwon Jo, Beomseok Kang, Jiwon Song, Jae-Joon Kim
2026-05-04
Computer Vision and Pattern Recognition · Computer Science
Accelerating Text-to-Video Generation with Calibrated Sparse Attention
Shai Yehezkel, Shahar Yadin, Noam Elata, Yaron Ostrovsky-Berman +1
2026-03-06
Computer Vision and Pattern Recognition · Computer Science
Inf-DiT: Upsampling Any-Resolution Image with Memory-Efficient Diffusion Transformer
Zhuoyi Yang, Heyang Jiang, Wenyi Hong, Jiayan Teng +4
2024-05-09
Computer Vision and Pattern Recognition · Computer Science
Fast Data Attribution for Text-to-Image Models
Sheng-Yu Wang, Aaron Hertzmann, Alexei A Efros, Richard Zhang +1
2025-11-17
Computer Vision and Pattern Recognition · Computer Science
Cached Adaptive Token Merging: Dynamic Token Reduction and Redundant Computation Elimination in Diffusion Model
Omid Saghatchian, Atiyeh Gh. Moghadam, Ahmad Nickabadi
2025-01-03