Computation and Language · Computer Science
V-FAT: Benchmarking Visual Fidelity Against Text-bias
Ziteng Wang, Yujie He, Guanliang Li, Siqi Yang +2
2026-01-09
Computer Vision and Pattern Recognition · Computer Science
Does Acceleration Cause Hidden Instability in Vision Language Models? Uncovering Instance-Level Divergence Through a Large-Scale Empirical Study
Yizheng Sun, Hao Li, Chang Xu, Hongpeng Zhou +3
2025-09-03
Computer Vision and Pattern Recognition · Computer Science
Seeing Isn't Believing: Uncovering Blind Spots in Evaluator Vision-Language Models
Mohammed Safi Ur Rahman Khan, Sanjay Suryanarayanan, Tushar Anand, Mitesh M. Khapra
2026-04-24
Computation and Language · Computer Science
VERITAS: A Unified Approach to Reliability Evaluation
Rajkumar Ramamurthy, Meghana Arakkal Rajeev, Oliver Molenschot, James Zou +1
2024-11-06
Artificial Intelligence · Computer Science
Seeing but Not Believing: Probing the Disconnect Between Visual Attention and Answer Correctness in VLMs
Zhining Liu, Ziyi Chen, Hui Liu, Chen Luo +8
2025-10-21
Computer Vision and Pattern Recognition · Computer Science
CounterCount: A Diagnostic Framework for Counting Bias in Vision Language Models
Reem Alzahrani, Hassan Alshanqiti, Bushra Bin Hemid, Zaid Alyafeai +2
2026-05-19
Computer Vision and Pattern Recognition · Computer Science
A Survey of State of the Art Large Vision Language Models: Alignment, Benchmark, Evaluations and Challenges
Zongxia Li, Xiyang Wu, Hongyang Du, Fuxiao Liu +2
2025-04-08
Computer Vision and Pattern Recognition · Computer Science
CVT-Bench: Counterfactual Viewpoint Transformations Reveal Unstable Spatial Representations in Multimodal LLMs
Shanmukha Vellamcheti, Uday Kiran Kothapalli, Disharee Bhowmick, Sathyanarayanan N. Aakur
2026-03-24
Computer Vision and Pattern Recognition · Computer Science
Are Multimodal LLMs Ready for Surveillance? A Reality Check on Zero-Shot Anomaly Detection in the Wild
Shanle Yao, Armin Danesh Pazho, Narges Rashvand, Hamed Tabkhi
2026-05-19
Computer Vision and Pattern Recognition · Computer Science
Seeing is Believing, but How Much? A Comprehensive Analysis of Verbalized Calibration in Vision-Language Models
Weihao Xuan, Qingcheng Zeng, Heli Qi, Junjue Wang +1
2025-05-27
Human-Computer Interaction · Computer Science
True (VIS) Lies: Analyzing How Generative AI Recognizes Intentionality, Rhetoric, and Misleadingness in Visualization Lies
Graziano Blasilli, Marco Angelini
2026-04-02
Computation and Language · Computer Science
Do Images Speak Louder than Words? Investigating the Effect of Textual Misinformation in VLMs
Chi Zhang, Wenxuan Ding, Jiale Liu, Mingrui Wu +2
2026-01-28
Computer Vision and Pattern Recognition · Computer Science
MASS: Motion-Aware Spatial-Temporal Grounding for Physics Reasoning and Comprehension in Vision-Language Models
Xiyang Wu, Zongxia Li, Jihui Jin, Guangyao Shi +6
2026-04-14
Computer Vision and Pattern Recognition · Computer Science
Mitigating Hallucination in Visual Language Models with Visual Supervision
Zhiyang Chen, Yousong Zhu, Yufei Zhan, Zhaowen Li +3
2023-11-29
Computation and Language · Computer Science
Disparities In Negation Understanding Across Languages In Vision-Language Models
Charikleia Moraitaki, Sarah Pan, Skyler Pulling, Gwendolyn Flusche +2
2026-04-22