Computer Vision and Pattern Recognition · Computer Science
R-Bench: Are your Large Multimodal Model Robust to Real-world Corruptions?
Chunyi Li, Jianbo Zhang, Zicheng Zhang, Haoning Wu +7
2024-10-10
Computer Vision and Pattern Recognition · Computer Science
Both Text and Images Leaked! A Systematic Analysis of Data Contamination in Multimodal LLM
Dingjie Song, Sicheng Lai, Mingxuan Wang, Shunian Chen +2
2025-09-23
Computer Vision and Pattern Recognition · Computer Science
MMR: Evaluating Reading Ability of Large Multimodal Models
Jian Chen, Ruiyi Zhang, Yufan Zhou, Ryan Rossi +2
2024-08-28
Computation and Language · Computer Science
LMMs-Eval: Reality Check on the Evaluation of Large Multimodal Models
Kaichen Zhang, Bo Li, Peiyuan Zhang, Fanyi Pu +7
2025-09-19
Artificial Intelligence · Computer Science
A Survey on Multimodal Benchmarks: In the Era of Large AI Models
Lin Li, Guikun Chen, Hanrong Shi, Jun Xiao +1
2024-09-30
Computer Vision and Pattern Recognition · Computer Science
MM-MoralBench: A MultiModal Moral Evaluation Benchmark for Large Vision-Language Models
Bei Yan, Jie Zhang, Zhiyuan Chen, Shiguang Shan +1
2026-04-10
Computer Vision and Pattern Recognition · Computer Science
COHERENCE: Benchmarking Fine-Grained Image-Text Alignment in Interleaved Multimodal Contexts
Bingli Wang, Huanze Tang, Haijun Lv, Zhishan Lin +4
2026-05-14
Computer Vision and Pattern Recognition · Computer Science
LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation
Ananya Raval, Aravind Narayanan, Vahid Reza Khazaie, Shaina Raza
2025-07-11
Computer Vision and Pattern Recognition · Computer Science
MM-SafetyBench: A Benchmark for Safety Evaluation of Multimodal Large Language Models
Xin Liu, Yichen Zhu, Jindong Gu, Yunshi Lan +2
2024-06-21
Computation and Language · Computer Science
A Survey on Benchmarks of Multimodal Large Language Models
Jian Li, Weiheng Lu, Hao Fei, Meng Luo +10
2024-09-09
Computer Vision and Pattern Recognition · Computer Science
MMGenBench: Fully Automatically Evaluating LMMs from the Text-to-Image Generation Perspective
Hailang Huang, Yong Wang, Zixuan Huang, Huaqiu Li +3
2025-03-11
Computer Vision and Pattern Recognition · Computer Science
MVTamperBench: Evaluating Robustness of Vision-Language Models
Amit Agarwal, Srikant Panda, Angeline Charles, Bhargava Kumar +7
2025-06-12
Computation and Language · Computer Science
VisualWebBench: How Far Have Multimodal LLMs Evolved in Web Page Understanding and Grounding?
Junpeng Liu, Yifan Song, Bill Yuchen Lin, Wai Lam +3
2024-04-10
Computation and Language · Computer Science
MFC-Bench: Benchmarking Multimodal Fact-Checking with Large Vision-Language Models
Shengkang Wang, Hongzhan Lin, Ziyang Luo, Zhen Ye +2
2025-02-18
Computer Vision and Pattern Recognition · Computer Science
MMT-Bench: A Comprehensive Multimodal Benchmark for Evaluating Large Vision-Language Models Towards Multitask AGI
Kaining Ying, Fanqing Meng, Jin Wang, Zhiqian Li +18
2024-04-25
Machine Learning · Computer Science
Benchmarking Multimodal Knowledge Conflict for Large Multimodal Models
Yifan Jia, Kailin Jiang, Yuyang Liang, Qihan Ren +10
2025-05-27
Computation and Language · Computer Science
MultiTrust: A Comprehensive Benchmark Towards Trustworthy Multimodal Large Language Models
Yichi Zhang, Yao Huang, Yitong Sun, Chang Liu +9
2024-12-09
Computer Vision and Pattern Recognition · Computer Science
MLLM-CompBench: A Comparative Reasoning Benchmark for Multimodal LLMs
Jihyung Kil, Zheda Mai, Justin Lee, Zihe Wang +5
2025-01-14
Computer Vision and Pattern Recognition · Computer Science
MMLongBench: Benchmarking Long-Context Vision-Language Models Effectively and Thoroughly
Zhaowei Wang, Wenhao Yu, Xiyu Ren, Jipeng Zhang +8
2025-10-07
Computer Vision and Pattern Recognition · Computer Science
Benchmarking Sequential Visual Input Reasoning and Prediction in Multimodal Large Language Models
Mingwei Zhu, Leigang Sha, Yu Shu, Kangjia Zhao +2
2023-10-23
Artificial Intelligence · Computer Science
INTEGRALBENCH: Benchmarking LLMs with Definite Integral Problems
Bintao Tang, Xin Yang, Yuhao Wang, Zixuan Qiu +2
2025-07-30
Computer Vision and Pattern Recognition · Computer Science
Res-Bench: Benchmarking the Robustness of Multimodal Large Language Models to Dynamic Resolution Input
Chenxu Li, Zhicai Wang, Yuan Sheng, Xingyu Zhu +2
2025-11-17
Computer Vision and Pattern Recognition · Computer Science
BenchLMM: Benchmarking Cross-style Visual Capability of Large Multimodal Models
Rizhao Cai, Zirui Song, Dayan Guan, Zhenhao Chen +3
2023-12-07
Computer Vision and Pattern Recognition · Computer Science
OCRBench v2: An Improved Benchmark for Evaluating Large Multimodal Models on Visual Text Localization and Reasoning
Ling Fu, Zhebin Kuang, Jiajun Song, Mingxin Huang +20
2025-06-06