Computer Vision and Pattern Recognition · Computer Science
MVPBench: A Multi-Video Perception Evaluation Benchmark for Multi-Modal Video Understanding
Purui Bai, Tao Wu, Jiayang Sun, Xinyue Liu +2
2026-03-25
Computer Vision and Pattern Recognition · Computer Science
EC-Bench: Enumeration and Counting Benchmark for Ultra-Long Videos
Fumihiko Tsuchiya, Taiki Miyanishi, Mahiro Ukai, Nakamasa Inoue +3
2026-04-01
Computer Vision and Pattern Recognition · Computer Science
CompareBench: A Benchmark for Visual Comparison Reasoning in Vision-Language Models
Jie Cai, Kangning Yang, Lan Fu, Jiaming Ding +5
2025-12-19
Computer Vision and Pattern Recognition · Computer Science
V2P-Bench: Evaluating Video-Language Understanding with Visual Prompts for Better Human-Model Interaction
Yiming Zhao, Yu Zeng, Yukun Qi, YaoYang Liu +7
2026-02-04
Computer Vision and Pattern Recognition · Computer Science
MVTamperBench: Evaluating Robustness of Vision-Language Models
Amit Agarwal, Srikant Panda, Angeline Charles, Bhargava Kumar +7
2025-06-12
Computer Vision and Pattern Recognition · Computer Science
Video-Bench: A Comprehensive Benchmark and Toolkit for Evaluating Video-based Large Language Models
Munan Ning, Bin Zhu, Yujia Xie, Bin Lin +4
2023-11-29
Computer Vision and Pattern Recognition · Computer Science
VP-Bench: A Comprehensive Benchmark for Visual Prompting in Multimodal Large Language Models
Mingjie Xu, Jinpeng Chen, Yuzhi Zhao, Jason Chun Lok Li +11
2025-11-17
Computer Vision and Pattern Recognition · Computer Science
ViLBench: A Suite for Vision-Language Process Reward Modeling
Haoqin Tu, Weitao Feng, Hardy Chen, Hui Liu +2
2025-03-27
Computer Vision and Pattern Recognition · Computer Science
VRBench: A Benchmark for Multi-Step Reasoning in Long Narrative Videos
Jiashuo Yu, Yue Wu, Meng Chu, Zhifei Ren +13
2025-08-05
Computer Vision and Pattern Recognition · Computer Science
IV-Bench: A Benchmark for Image-Grounded Video Perception and Reasoning in Multimodal LLMs
David Ma, Yuanxing Zhang, Jincheng Ren, Jarvis Guo +16
2025-04-23
Computer Vision and Pattern Recognition · Computer Science
VirtueBench: Evaluating Trustworthiness under Uncertainty in Long Video Understanding
Xueqing Yu, Bohan Li, Yan Li, Zhenheng Yang
2026-03-11
Computer Vision and Pattern Recognition · Computer Science
CountCLIP -- [Re] Teaching CLIP to Count to Ten
Harshvardhan Mestha, Tejas Agrawal, Karan Bania, Shreyas V +1
2024-06-11
Computer Vision and Pattern Recognition · Computer Science
[De|Re]constructing VLMs' Reasoning in Counting
Simone Alghisi, Gabriel Roccabruna, Massimo Rizzoli, Seyed Mahed Mousavi +1
2025-10-23
Computer Vision and Pattern Recognition · Computer Science
UniBench: Visual Reasoning Requires Rethinking Vision-Language Beyond Scaling
Haider Al-Tahan, Quentin Garrido, Randall Balestriero, Diane Bouchacourt +2
2024-08-12
Computer Vision and Pattern Recognition · Computer Science
MotionBench: Benchmarking and Improving Fine-grained Video Motion Understanding for Vision Language Models
Wenyi Hong, Yean Cheng, Zhuoyi Yang, Weihan Wang +5
2026-05-13
Computer Vision and Pattern Recognition · Computer Science
VisNumBench: Evaluating Number Sense of Multimodal Large Language Models
Tengjin Weng, Jingyi Wang, Wenhao Jiang, Zhong Ming
2025-08-01
Computer Vision and Pattern Recognition · Computer Science
Teaching CLIP to Count to Ten
Roni Paiss, Ariel Ephrat, Omer Tov, Shiran Zada +3
2023-02-24
Computer Vision and Pattern Recognition · Computer Science
MMLongBench: Benchmarking Long-Context Vision-Language Models Effectively and Thoroughly
Zhaowei Wang, Wenhao Yu, Xiyu Ren, Jipeng Zhang +8
2025-10-07
Computer Vision and Pattern Recognition · Computer Science
VLRMBench: A Comprehensive and Challenging Benchmark for Vision-Language Reward Models
Jiacheng Ruan, Wenzhen Yuan, Xian Gao, Ye Guo +5
2025-03-11
Computer Vision and Pattern Recognition · Computer Science
Your Vision-Language Model Can't Even Count to 20: Exposing the Failures of VLMs in Compositional Counting
Xuyang Guo, Zekai Huang, Zhenmei Shi, Zhao Song +1
2025-10-07
Computer Vision and Pattern Recognition · Computer Science
VideoRewardBench: Comprehensive Evaluation of Multimodal Reward Models for Video Understanding
Zhihong Zhang, Xiaojian Huang, Jin Xu, Zhuodong Luo +3
2025-09-03
Computer Vision and Pattern Recognition · Computer Science
LongVideoBench: A Benchmark for Long-context Interleaved Video-Language Understanding
Haoning Wu, Dongxu Li, Bei Chen, Junnan Li
2024-07-23
Computer Vision and Pattern Recognition · Computer Science
FineBench: Benchmarking and Enhancing Vision-Language Models for Fine-grained Human Activity Understanding
Gueter Josmy Faure, Min-Hung Chen, Jia-Fong Yeh, Hung-Ting Su +1
2026-05-26
Computer Vision and Pattern Recognition · Computer Science
ZeroBench: An Impossible Visual Benchmark for Contemporary Large Multimodal Models
Jonathan Roberts, Mohammad Reza Taesiri, Ansh Sharma, Akash Gupta +30
2025-03-07
Computer Vision and Pattern Recognition · Computer Science
InstructionBench: An Instructional Video Understanding Benchmark
Haiwan Wei, Yitian Yuan, Xiaohan Lan, Wei Ke +1
2025-07-01