Computer Vision and Pattern Recognition · Computer Science
Jailbreak Large Vision-Language Models Through Multi-Modal Linkage
Yu Wang, Xiaofei Zhou, Yichen Wang, Geyuan Zhang +1
2025-06-19
Cryptography and Security · Computer Science
Align is not Enough: Multimodal Universal Jailbreak Attack against Multimodal Large Language Models
Youze Wang, Wenbo Hu, Yinpeng Dong, Jing Liu +2
2025-06-03
Computation and Language · Computer Science
Audio Is the Achilles' Heel: Red Teaming Audio Large Multimodal Models
Hao Yang, Lizhen Qu, Ehsan Shareghi, Gholamreza Haffari
2024-11-01
Computer Vision and Pattern Recognition · Computer Science
MIDAS: Multi-Image Dispersion and Semantic Reconstruction for Jailbreaking MLLMs
Yilian Liu, Xiaojun Jia, Guoshun Nan, Jiuyang Lyu +5
2026-03-03
Computer Vision and Pattern Recognition · Computer Science
Beyond Visual Safety: Jailbreaking Multimodal Large Language Models for Harmful Image Generation via Semantic-Agnostic Inputs
Mingyu Yu, Lana Liu, Zhehao Zhao, Wei Wang +1
2026-01-23
Computer Vision and Pattern Recognition · Computer Science
Exploring Visual Vulnerabilities via Multi-Loss Adversarial Search for Jailbreaking Vision-Language Models
Shuyang Hao, Bryan Hooi, Jun Liu, Kai-Wei Chang +2
2024-12-02
Computer Vision and Pattern Recognition · Computer Science
Robustness of Vision Language Models Against Split-Image Harmful Input Attacks
Md Rafi Ur Rashid, MD Sadik Hossain Shanto, Vishnu Asutosh Dasu, Shagufta Mehnaz
2026-02-10
Cryptography and Security · Computer Science
JailDAM: Jailbreak Detection with Adaptive Memory for Vision-Language Model
Yi Nian, Shenzhe Zhu, Yuehan Qin, Li Li +3
2025-07-18
Cryptography and Security · Computer Science
Unbridled Icarus: A Survey of the Potential Perils of Image Inputs in Multimodal Large Language Model Security
Yihe Fan, Yuxin Cao, Ziyu Zhao, Ziyao Liu +1
2024-08-13
Cryptography and Security · Computer Science
Visual Adversarial Examples Jailbreak Aligned Large Language Models
Xiangyu Qi, Kaixuan Huang, Ashwinee Panda, Peter Henderson +2
2023-08-21
Computer Vision and Pattern Recognition · Computer Science
Seeing No Evil: Blinding Large Vision-Language Models to Safety Instructions via Adversarial Attention Hijacking
Jingru Li, Wei Ren, Tianqing Zhu
2026-04-14
Computer Vision and Pattern Recognition · Computer Science
ImgTrojan: Jailbreaking Vision-Language Models with ONE Image
Xijia Tao, Shuai Zhong, Lei Li, Qi Liu +1
2025-09-30
Cryptography and Security · Computer Science
DMN: A Compositional Framework for Jailbreaking Multimodal LLMs with Multi-Image Inputs
Wenzhuo Xu, Zhipeng Wei, Zonghao Ying, Deyue Zhang +3
2026-05-20
Computation and Language · Computer Science
HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States
Yilei Jiang, Xinyan Gao, Tianshuo Peng, Yingshui Tan +3
2025-06-24
Cryptography and Security · Computer Science
PolyJailbreak: Cross-Modal Jailbreaking Attacks on Black-Box Multimodal LLMs
Xinkai Wang, Beibei Li, Zerui Shao, Ao Liu +2
2026-03-10
Artificial Intelligence · Computer Science
Efficient LLM-Jailbreaking via Multimodal-LLM Jailbreak
Haoxuan Ji, Zheng Lin, Zhenxing Niu, Xinbo Gao +1
2025-12-02
Computer Vision and Pattern Recognition · Computer Science
White-box Multimodal Jailbreaks Against Large Vision-Language Models
Ruofan Wang, Xingjun Ma, Hanxu Zhou, Chuanjun Ji +2
2024-10-15
Machine Learning · Computer Science
Jailbreaking Attack against Multimodal Large Language Model
Zhenxing Niu, Haodong Ren, Xinbo Gao, Gang Hua +1
2024-02-07
Machine Learning · Computer Science
Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models
Zhaoxin Wang, Handing Wang, Cong Tian, Yaochu Jin
2025-05-23
Cryptography and Security · Computer Science
BaThe: Defense against the Jailbreak Attack in Multimodal Large Language Models by Treating Harmful Instruction as Backdoor Trigger
Yulin Chen, Haoran Li, Yirui Zhang, Zihao Zheng +2
2025-04-23
Computer Vision and Pattern Recognition · Computer Science
Jailbreaking Vision-Language Models Through the Visual Modality
Aharon Azulay, Jan Dubiński, Zhuoyun Li, Atharv Mittal +1
2026-05-04