Computation and Language · Computer Science
The mutual exclusivity bias of bilingual visually grounded speech models
Dan Oneata, Leanne Nortje, Yevgen Matusevych, Herman Kamper
2025-06-05
Computation and Language · Computer Science
Visually Grounded Speech Models have a Mutual Exclusivity Bias
Leanne Nortje, Dan Oneaţă, Yevgen Matusevych, Herman Kamper
2024-03-25
Computer Vision and Pattern Recognition · Computer Science
PEBench: A Fictitious Dataset to Benchmark Machine Unlearning for Multimodal Large Language Models
Zhaopan Xu, Pengfei Zhou, Weidong Tang, Jiaxin Ai +6
2025-07-23
Computer Vision and Pattern Recognition · Computer Science
ViewSpatial-Bench: Evaluating Multi-perspective Spatial Localization in Vision-Language Models
Dingming Li, Hongxing Li, Zixuan Wang, Yuchen Yan +8
2025-10-01
Computer Vision and Pattern Recognition · Computer Science
Do Vision-Language Models Measure Up? Benchmarking Visual Measurement Reading with MeasureBench
Fenfen Lin, Yesheng Liu, Haiyu Xu, Chen Yue +6
2026-03-25
Computer Vision and Pattern Recognition · Computer Science
Seeing Is Believing? A Benchmark for Multimodal Large Language Models on Visual Illusions and Anomalies
Wenjin Hou, Wei Liu, Han Hu, Xiaoxiao Sun +2
2026-02-03
Computer Vision and Pattern Recognition · Computer Science
MIBench: Evaluating Multimodal Large Language Models over Multiple Images
Haowei Liu, Xi Zhang, Haiyang Xu, Yaya Shi +7
2024-10-10
Computer Vision and Pattern Recognition · Computer Science
CompareBench: A Benchmark for Visual Comparison Reasoning in Vision-Language Models
Jie Cai, Kangning Yang, Lan Fu, Jiaming Ding +5
2025-12-19
Computer Vision and Pattern Recognition · Computer Science
VISTA-Bench: Do Vision-Language Models Really Understand Visualized Text as Well as Pure Text?
Qing'an Liu, Juntong Feng, Yuhao Wang, Xinzhe Han +5
2026-05-19
Computer Vision and Pattern Recognition · Computer Science
VisRes Bench: On Evaluating the Visual Reasoning Capabilities of VLMs
Brigitta Malagurski Törtei, Yasser Dahou, Ngoc Dung Huynh, Wamiq Reyaz Para +4
2025-12-25
Artificial Intelligence · Computer Science
VLind-Bench: Measuring Language Priors in Large Vision-Language Models
Kang-il Lee, Minbeom Kim, Seunghyun Yoon, Minsung Kim +3
2025-02-11
Computation and Language · Computer Science
Visual Reasoning Benchmark: Evaluating Multimodal LLMs on Classroom-Authentic Visual Problems from Primary Education
Mohamed Huti, Alasdair Mackintosh, Amy Waldock, Dominic Andrews +6
2026-02-13
Computer Vision and Pattern Recognition · Computer Science
VERIFY: A Benchmark of Visual Explanation and Reasoning for Investigating Multimodal Reasoning Fidelity
Jing Bi, Junjia Guo, Susan Liang, Guangyu Sun +7
2025-03-17
Computer Vision and Pattern Recognition · Computer Science
VER-Bench: Evaluating MLLMs on Reasoning with Fine-Grained Visual Evidence
Chenhui Qiang, Zhaoyang Wei, Xumeng Han, Zipeng Wang +4
2025-09-25
Computer Vision and Pattern Recognition · Computer Science
DO-Bench: An Attributable Benchmark for Diagnosing Object Hallucination in Vision-Language Models
JiYang Wang, Jiawei Chen, Mengqi Xiao, Yu Cheng +2
2026-04-28
Computer Vision and Pattern Recognition · Computer Science
MMBench: Is Your Multi-modal Model an All-around Player?
Yuan Liu, Haodong Duan, Yuanhan Zhang, Bo Li +8
2024-08-21
Computer Vision and Pattern Recognition · Computer Science
Low-shot Object Learning with Mutual Exclusivity Bias
Anh Thai, Ahmad Humayun, Stefan Stojanov, Zixuan Huang +2
2023-12-07
Computer Vision and Pattern Recognition · Computer Science
MOSABench: Multi-Object Sentiment Analysis Benchmark for Evaluating Multimodal Large Language Models Understanding of Complex Image
Shezheng Song, Chengxiang He, Shan Zhao, Chengyu Wang +3
2025-11-17
Computer Vision and Pattern Recognition · Computer Science
JourneyBench: A Challenging One-Stop Vision-Language Understanding Benchmark of Generated Images
Zhecan Wang, Junzhang Liu, Chia-Wei Tang, Hani Alomari +10
2025-01-13
Computer Vision and Pattern Recognition · Computer Science
Benchmarking Sequential Visual Input Reasoning and Prediction in Multimodal Large Language Models
Mingwei Zhu, Leigang Sha, Yu Shu, Kangjia Zhao +2
2023-10-23
Robotics · Computer Science
ManipBench: Benchmarking Vision-Language Models for Low-Level Robot Manipulation
Enyu Zhao, Vedant Raval, Hejia Zhang, Jiageng Mao +4
2025-09-03
Artificial Intelligence · Computer Science
Reasoning Path and Latent State Analysis for Multi-view Visual Spatial Reasoning: A Cognitive Science Perspective
Qiyao Xue, Weichen Liu, Shiqi Wang, Haoming Wang +2
2025-12-03
Computer Vision and Pattern Recognition · Computer Science
MCTBench: Multimodal Cognition towards Text-Rich Visual Scenes Benchmark
Bin Shan, Xiang Fei, Wei Shi, An-Lan Wang +5
2024-10-16
Machine Learning · Computer Science
PairBench: Are Vision-Language Models Reliable at Comparing What They See?
Aarash Feizi, Sai Rajeswar, Adriana Romero-Soriano, Reihaneh Rabbany +3
2025-06-02