中文

大型视觉-语言模型中压缩式投影器的安全威胁

密码学与安全 2025-10-07 v2 人工智能

摘要

选择合适的视觉语言投影器(VLP)对于大型视觉语言模型(LVLMs)的成功训练至关重要。主流 VLP 大致可分为压缩式和非压缩式投影器,两者在性能和计算效率上各有优势。然而,它们的安全影响尚未得到深入考察。我们的综合评估揭示了两者在安全特性上的显著差异:压缩式投影器表现出严重的脆弱性,使得攻击者即使对结构信息了解极少,也能成功攻破 LVLMs。形成鲜明对比的是,非压缩式投影器展现出稳健的安全特性,且不会引入额外漏洞。这些发现为研究人员选择最优 VLP 以增强视觉语言模型的安全性和可靠性提供了关键指导。代码可在 https://github.com/btzyd/TCP 获取。

关键词

引用

@article{arxiv.2506.00534,
  title  = {The Security Threat of Compressed Projectors in Large Vision-Language Models},
  author = {Yudong Zhang and Ruobing Xie and Xingwu Sun and Jiansheng Chen and Zhanhui Kang and Di Wang and Yu Wang},
  journal= {arXiv preprint arXiv:2506.00534},
  year   = {2025}
}

备注

Accepted by EMNLP 2025 findings