Computer Vision and Pattern Recognition · Computer Science
VP-Bench: A Comprehensive Benchmark for Visual Prompting in Multimodal Large Language Models
Mingjie Xu, Jinpeng Chen, Yuzhi Zhao, Jason Chun Lok Li +11
2025-11-17
Computer Vision and Pattern Recognition · Computer Science
HumanVideo-MME: Benchmarking MLLMs for Human-Centric Video Understanding
Yuxuan Cai, Jiangning Zhang, Zhenye Gan, Qingdong He +8
2025-10-01
Computation and Language · Computer Science
HSSBench: Benchmarking Humanities and Social Sciences Ability for Multimodal Large Language Models
Zhaolu Kang, Junhao Gong, Jiaxu Yan, Wanke Xia +14
2026-03-04
Computer Vision and Pattern Recognition · Computer Science
Seeing from Another Perspective: Evaluating Multi-View Understanding in MLLMs
Chun-Hsiao Yeh, Chenyu Wang, Shengbang Tong, Ta-Ying Cheng +6
2025-04-29
Computer Vision and Pattern Recognition · Computer Science
Benchmarking Sequential Visual Input Reasoning and Prediction in Multimodal Large Language Models
Mingwei Zhu, Leigang Sha, Yu Shu, Kangjia Zhao +2
2023-10-23
Computer Vision and Pattern Recognition · Computer Science
HumanVBench: Probing Human-Centric Video Understanding in MLLMs with Automatically Synthesized Benchmarks
Ting Zhou, Daoyuan Chen, Qirui Jiao, Bolin Ding +2
2026-04-14
Computation and Language · Computer Science
11Plus-Bench: Demystifying Multimodal LLM Spatial Reasoning with Cognitive-Inspired Analysis
Chengzu Li, Wenshan Wu, Huanyu Zhang, Qingtao Li +5
2025-08-28
Artificial Intelligence · Computer Science
SpatialBench: Benchmarking Multimodal Large Language Models for Spatial Cognition
Peiran Xu, Sudong Wang, Yao Zhu, Jianing Li +2
2026-05-08
Computer Vision and Pattern Recognition · Computer Science
VisNumBench: Evaluating Number Sense of Multimodal Large Language Models
Tengjin Weng, Jingyi Wang, Wenhao Jiang, Zhong Ming
2025-08-01
Computation and Language · Computer Science
A Survey on Benchmarks of Multimodal Large Language Models
Jian Li, Weiheng Lu, Hao Fei, Meng Luo +10
2024-09-09
Computer Vision and Pattern Recognition · Computer Science
Seeing Is Believing? A Benchmark for Multimodal Large Language Models on Visual Illusions and Anomalies
Wenjin Hou, Wei Liu, Han Hu, Xiaoxiao Sun +2
2026-02-03
Computer Vision and Pattern Recognition · Computer Science
Human-MME: A Holistic Evaluation Benchmark for Human-Centric Multimodal Large Language Models
Yuansen Liu, Haiming Tang, Jinlong Peng, Jiangning Zhang +11
2025-10-16
Computer Vision and Pattern Recognition · Computer Science
HM-Bench: A Comprehensive Benchmark for Multimodal Large Language Models in Hyperspectral Remote Sensing
Xinyu Zhang, Zurong Mai, Qingmei Li, Zjin Liao +12
2026-04-13
Robotics · Computer Science
HRIBench: Benchmarking Vision-Language Models for Real-Time Human Perception in Human-Robot Interaction
Zhonghao Shi, Enyu Zhao, Nathaniel Dennler, Jingzhen Wang +5
2025-06-26
Computer Vision and Pattern Recognition · Computer Science
Human Cognitive Benchmarks Reveal Foundational Visual Gaps in MLLMs
Jen-Tse Huang, Dasen Dai, Jen-Yuan Huang, Youliang Yuan +6
2026-05-05
Computation and Language · Computer Science
MANBench: Is Your Multimodal Model Smarter than Human?
Han Zhou, Qitong Xu, Yiheng Dong, Xin Yang
2025-06-16
Computer Vision and Pattern Recognition · Computer Science
Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models
Zhaochen Liu, Kaiwen Gao, Shuyi Liang, Bin Xiao +3
2025-08-07
Computer Vision and Pattern Recognition · Computer Science
LENS: Multi-level Evaluation of Multimodal Reasoning with Large Language Models
Ruilin Yao, Bo Zhang, Jirui Huang, Xinwei Long +17
2026-05-14
Computer Vision and Pattern Recognition · Computer Science
VisuLogic: A Benchmark for Evaluating Visual Reasoning in Multi-modal Large Language Models
Weiye Xu, Jiahao Wang, Weiyun Wang, Zhe Chen +9
2025-04-22
Computer Vision and Pattern Recognition · Computer Science
AVHBench: A Cross-Modal Hallucination Benchmark for Audio-Visual Large Language Models
Kim Sung-Bin, Oh Hyun-Bin, JungMok Lee, Arda Senocak +2
2025-03-18
Computer Vision and Pattern Recognition · Computer Science
CVBench: Benchmarking Cross-Video Synergies for Complex Multimodal Reasoning
Nannan Zhu, Yonghao Dong, Teng Wang, Xueqian Li +8
2026-01-07
Computer Vision and Pattern Recognition · Computer Science
HumaniBench: A Human-Centric Framework for Large Multimodal Models Evaluation
Shaina Raza, Aravind Narayanan, Vahid Reza Khazaie, Ashmal Vayani +5
2025-12-01
Computer Vision and Pattern Recognition · Computer Science
ViewSpatial-Bench: Evaluating Multi-perspective Spatial Localization in Vision-Language Models
Dingming Li, Hongxing Li, Zixuan Wang, Yuchen Yan +8
2025-10-01