Computer Vision and Pattern Recognition · Computer Science
Benchmarking Large Vision-Language Models on Fine-Grained Image Tasks: A Comprehensive Evaluation
Hong-Tao Yu, Yuxin Peng, Serge Belongie, Xiu-Shen Wei
2026-05-01
Computer Vision and Pattern Recognition · Computer Science
Benchmarking Multimodal Mathematical Reasoning with Explicit Visual Dependency
Zhikai Wang, Jiashuo Sun, Wenqi Zhang, Zhiqiang Hu +3
2025-05-14
Computer Vision and Pattern Recognition · Computer Science
Reasoning or Pattern Matching? Probing Large Vision-Language Models with Visual Puzzles
Maria Lymperaiou, Vasileios Karampinis, Giorgos Filandrianos, Angelos Vlachos +2
2026-01-21
Computer Vision and Pattern Recognition · Computer Science
IQBench: How "Smart'' Are Vision-Language Models? A Study with Human IQ Tests
Tan-Hanh Pham, Phu-Vinh Nguyen, Dang The Hung, Bui Trong Duong +4
2025-05-20
Computer Vision and Pattern Recognition · Computer Science
A Study of Commonsense Reasoning over Visual Object Properties
Abhishek Kolari, Mohammadhossein Khojasteh, Yifan Jiang, Floris den Hengst +1
2026-01-16
Computer Vision and Pattern Recognition · Computer Science
VisuLogic: A Benchmark for Evaluating Visual Reasoning in Multi-modal Large Language Models
Weiye Xu, Jiahao Wang, Weiyun Wang, Zhe Chen +9
2025-04-22
Computer Vision and Pattern Recognition · Computer Science
LENS: Multi-level Evaluation of Multimodal Reasoning with Large Language Models
Ruilin Yao, Bo Zhang, Jirui Huang, Xinwei Long +17
2026-05-14
Computer Vision and Pattern Recognition · Computer Science
Mementos: A Comprehensive Benchmark for Multimodal Large Language Model Reasoning over Image Sequences
Xiyao Wang, Yuhang Zhou, Xiaoyu Liu, Hongjin Lu +8
2024-01-26
Computer Vision and Pattern Recognition · Computer Science
Beyond Seeing: Evaluating Multimodal LLMs on Tool-Enabled Image Perception, Transformation, and Reasoning
Xingang Guo, Utkarsh Tyagi, Advait Gosai, Paula Vergara +7
2025-10-28
Computer Vision and Pattern Recognition · Computer Science
HumanEval-V: Benchmarking High-Level Visual Reasoning with Complex Diagrams in Coding Tasks
Fengji Zhang, Linquan Wu, Huiyu Bai, Guancheng Lin +5
2025-02-19
Computer Vision and Pattern Recognition · Computer Science
MMDocBench: Benchmarking Large Vision-Language Models for Fine-Grained Visual Document Understanding
Fengbin Zhu, Ziyang Liu, Xiang Yao Ng, Haohui Wu +5
2024-10-30
Computation and Language · Computer Science
Benchmarking and Improving Large Vision-Language Models for Fundamental Visual Graph Understanding and Reasoning
Yingjie Zhu, Xuefeng Bai, Kehai Chen, Yang Xiang +2
2025-06-09
Computer Vision and Pattern Recognition · Computer Science
What, Whether and How? Unveiling Process Reward Models for Thinking with Images Reasoning
Yujin Zhou, Pengcheng Wen, Jiale Chen, Boqin Yin +5
2026-02-10
Computer Vision and Pattern Recognition · Computer Science
Mind's Eye: A Benchmark of Visual Abstraction, Transformation and Composition for Multimodal LLMs
Rohit Sinha, Aditya Kanade, Sai Srinivas Kancheti, Vineeth N Balasubramanian +1
2026-04-20
Computer Vision and Pattern Recognition · Computer Science
Hidden Meanings in Plain Sight: RebusBench for Evaluating Cognitive Visual Reasoning
Seyed Amir Kasaei, Arash Marioriyad, Mahbod Khaleti, MohammadAmin Fazli +2
2026-04-03
Computer Vision and Pattern Recognition · Computer Science
More Images, More Problems? A Controlled Analysis of VLM Failure Modes
Anurag Das, Adrian Bulat, Alberto Baldrati, Ioannis Maniadis Metaxas +3
2026-01-13
Computer Vision and Pattern Recognition · Computer Science
Benchmarking Multi-Image Understanding in Vision and Language Models: Perception, Knowledge, Reasoning, and Multi-Hop Reasoning
Bingchen Zhao, Yongshuo Zong, Letian Zhang, Timothy Hospedales
2024-06-19
Artificial Intelligence · Computer Science
LogicVista: Multimodal LLM Logical Reasoning Benchmark in Visual Contexts
Yijia Xiao, Edward Sun, Tianyu Liu, Wei Wang
2024-07-09
Computer Vision and Pattern Recognition · Computer Science
OMIBench: Benchmarking Olympiad-Level Multi-Image Reasoning in Large Vision-Language Model
Qiguang Chen, Chengyu Luan, Jiajun Wu, Qiming Yu +6
2026-04-23
Computation and Language · Computer Science
IRR: Image Review Ranking Framework for Evaluating Vision-Language Models
Kazuki Hayashi, Kazuma Onishi, Toma Suzuki, Yusuke Ide +6
2024-12-17