Computer Vision and Pattern Recognition · Computer Science
AutoBench-V: Can Large Vision-Language Models Benchmark Themselves?
Han Bao, Yue Huang, Yanbo Wang, Jiayi Ye +6
2025-03-07
Computer Vision and Pattern Recognition · Computer Science
Benchmarking Large Vision-Language Models on Fine-Grained Image Tasks: A Comprehensive Evaluation
Hong-Tao Yu, Yuxin Peng, Serge Belongie, Xiu-Shen Wei
2026-05-01
Computer Vision and Pattern Recognition · Computer Science
MMT-Bench: A Comprehensive Multimodal Benchmark for Evaluating Large Vision-Language Models Towards Multitask AGI
Kaining Ying, Fanqing Meng, Jin Wang, Zhiqian Li +18
2024-04-25
Computer Vision and Pattern Recognition · Computer Science
ReForm-Eval: Evaluating Large Vision Language Models via Unified Re-Formulation of Task-Oriented Benchmarks
Zejun Li, Ye Wang, Mengfei Du, Qingwen Liu +8
2023-10-18
Computer Vision and Pattern Recognition · Computer Science
Video-Bench: A Comprehensive Benchmark and Toolkit for Evaluating Video-based Large Language Models
Munan Ning, Bin Zhu, Yujia Xie, Bin Lin +4
2023-11-29
Computer Vision and Pattern Recognition · Computer Science
PROGRESSLM: Towards Progress Reasoning in Vision-Language Models
Jianshu Zhang, Chengxuan Qian, Haosen Sun, Haoran Lu +3
2026-05-25
Computer Vision and Pattern Recognition · Computer Science
Flat-Pack Bench: Evaluating Spatio-Temporal Understanding in Large Vision-Language Models through Furniture Assembly
Aditya Chetan, Eric Cai, Peeyush Kushwaha, Bharath Raj Nagoor Kani +4
2026-05-22
Machine Learning · Computer Science
FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models
Weiying Zheng, Ziyue Lin, Pengxin Guo, Yuyin Zhou +2
2025-06-12
Computer Vision and Pattern Recognition · Computer Science
UniBench: Visual Reasoning Requires Rethinking Vision-Language Beyond Scaling
Haider Al-Tahan, Quentin Garrido, Randall Balestriero, Diane Bouchacourt +2
2024-08-12
Machine Learning · Computer Science
PairBench: Are Vision-Language Models Reliable at Comparing What They See?
Aarash Feizi, Sai Rajeswar, Adriana Romero-Soriano, Reihaneh Rabbany +3
2025-06-02
Computation and Language · Computer Science
LLMeBench: A Flexible Framework for Accelerating LLMs Benchmarking
Fahim Dalvi, Maram Hasanain, Sabri Boughorbel, Basel Mousi +9
2024-02-27
Machine Learning · Computer Science
LLM-Inference-Bench: Inference Benchmarking of Large Language Models on AI Accelerators
Krishna Teja Chitty-Venkata, Siddhisanket Raskar, Bharat Kale, Farah Ferdaus +5
2024-11-04
Machine Learning · Computer Science
AE-LLM: Adaptive Efficiency Optimization for Large Language Models
Kaito Tanaka, Masato Ito, Yuji Nishimura, Keisuke Matsuda +1
2026-03-24
Computer Vision and Pattern Recognition · Computer Science
VP-Bench: A Comprehensive Benchmark for Visual Prompting in Multimodal Large Language Models
Mingjie Xu, Jinpeng Chen, Yuzhi Zhao, Jason Chun Lok Li +11
2025-11-17
Computer Vision and Pattern Recognition · Computer Science
LVLM-eHub: A Comprehensive Evaluation Benchmark for Large Vision-Language Models
Peng Xu, Wenqi Shao, Kaipeng Zhang, Peng Gao +6
2023-06-16
Computer Vision and Pattern Recognition · Computer Science
FlashVLM: Text-Guided Visual Token Selection for Large Multimodal Models
Kaitong Cai, Jusheng Zhang, Jing Yang, Yijia Fan +3
2025-12-24
Computer Vision and Pattern Recognition · Computer Science
MMBench: Is Your Multi-modal Model an All-around Player?
Yuan Liu, Haodong Duan, Yuanhan Zhang, Bo Li +8
2024-08-21
Computer Vision and Pattern Recognition · Computer Science
MMLongBench: Benchmarking Long-Context Vision-Language Models Effectively and Thoroughly
Zhaowei Wang, Wenhao Yu, Xiyu Ren, Jipeng Zhang +8
2025-10-07
Computer Vision and Pattern Recognition · Computer Science
Large Language Models as Automated Aligners for benchmarking Vision-Language Models
Yuanfeng Ji, Chongjian Ge, Weikai Kong, Enze Xie +3
2023-11-27
Computation and Language · Computer Science
EfficientLLM: Efficiency in Large Language Models
Zhengqing Yuan, Weixiang Sun, Yixin Liu, Huichi Zhou +12
2025-05-21
Computer Vision and Pattern Recognition · Computer Science
Evaluating Vision-Language Models as Evaluators in Path Planning
Mohamed Aghzal, Xiang Yue, Erion Plaku, Ziyu Yao
2025-05-19
Computer Vision and Pattern Recognition · Computer Science
Does Acceleration Cause Hidden Instability in Vision Language Models? Uncovering Instance-Level Divergence Through a Large-Scale Empirical Study
Yizheng Sun, Hao Li, Chang Xu, Hongpeng Zhou +3
2025-09-03
Computation and Language · Computer Science
EffiEval: Efficient and Generalizable Model Evaluation via Capability Coverage Maximization
Yaoning Wang, Jiahao Ying, Yixin Cao, Yubo Ma +1
2025-08-14