Computer Vision and Pattern Recognition · Computer Science
LocateEdit-Bench: A Benchmark for Instruction-Based Editing Localization
Shiyu Wu, Shuyan Li, Jing Li, Jing Liu +1
2026-02-06
Computer Vision and Pattern Recognition · Computer Science
From Pixels to Places: A Systematic Benchmark for Evaluating Image Geolocalization Ability in Large Language Models
Lingyao Li, Runlong Yu, Qikai Hu, Bowei Li +3
2026-05-19
Computer Vision and Pattern Recognition · Computer Science
ViewSpatial-Bench: Evaluating Multi-perspective Spatial Localization in Vision-Language Models
Dingming Li, Hongxing Li, Zixuan Wang, Yuchen Yan +8
2025-10-01
Computer Vision and Pattern Recognition · Computer Science
7Bench: a Comprehensive Benchmark for Layout-guided Text-to-image Models
Elena Izzo, Luca Parolari, Davide Vezzaro, Lamberto Ballan
2025-08-19
Machine Learning · Computer Science
PairBench: Are Vision-Language Models Reliable at Comparing What They See?
Aarash Feizi, Sai Rajeswar, Adriana Romero-Soriano, Reihaneh Rabbany +3
2025-06-02
Computation and Language · Computer Science
II-Bench: An Image Implication Understanding Benchmark for Multimodal Large Language Models
Ziqiang Liu, Feiteng Fang, Xi Feng, Xinrun Du +22
2025-01-14
Computer Vision and Pattern Recognition · Computer Science
Beyond the Visible: Benchmarking Occlusion Perception in Multimodal Large Language Models
Zhaochen Liu, Kaiwen Gao, Shuyi Liang, Bin Xiao +3
2025-08-07
Machine Learning · Computer Science
TDBench: A Benchmark for Top-Down Image Understanding with Reliability Analysis of Vision-Language Models
Kaiyuan Hou, Minghui Zhao, Lilin Xu, Yuang Fan +1
2025-10-02
Computer Vision and Pattern Recognition · Computer Science
Do Vision-Language Models Measure Up? Benchmarking Visual Measurement Reading with MeasureBench
Fenfen Lin, Yesheng Liu, Haiyu Xu, Chen Yue +6
2026-03-25
Computer Vision and Pattern Recognition · Computer Science
RotBench: Evaluating Multimodal Large Language Models on Identifying Image Rotation
Tianyi Niu, Jaemin Cho, Elias Stengel-Eskin, Mohit Bansal
2026-01-27
Computer Vision and Pattern Recognition · Computer Science
NaturalBench: Evaluating Vision-Language Models on Natural Adversarial Samples
Baiqi Li, Zhiqiu Lin, Wenxuan Peng, Jean de Dieu Nyandwi +6
2025-06-11
Computer Vision and Pattern Recognition · Computer Science
CompareBench: A Benchmark for Visual Comparison Reasoning in Vision-Language Models
Jie Cai, Kangning Yang, Lan Fu, Jiaming Ding +5
2025-12-19
Computation and Language · Computer Science
REBUS: A Robust Evaluation Benchmark of Understanding Symbols
Andrew Gritsevskiy, Arjun Panickssery, Aaron Kirtland, Derik Kauffman +6
2024-06-05
Computer Vision and Pattern Recognition · Computer Science
JourneyBench: A Challenging One-Stop Vision-Language Understanding Benchmark of Generated Images
Zhecan Wang, Junzhang Liu, Chia-Wei Tang, Hani Alomari +10
2025-01-13
Computer Vision and Pattern Recognition · Computer Science
Large Language Models as Automated Aligners for benchmarking Vision-Language Models
Yuanfeng Ji, Chongjian Ge, Weikai Kong, Enze Xie +3
2023-11-27
Computer Vision and Pattern Recognition · Computer Science
NavBench: Probing Multimodal Large Language Models for Embodied Navigation
Yanyuan Qiao, Haodong Hong, Wenqi Lyu, Dong An +4
2025-06-03
Computer Vision and Pattern Recognition · Computer Science
GIE-Bench: Towards Grounded Evaluation for Text-Guided Image Editing
Yusu Qian, Jiasen Lu, Tsu-Jui Fu, Xinze Wang +4
2025-07-28
Artificial Intelligence · Computer Science
VLind-Bench: Measuring Language Priors in Large Vision-Language Models
Kang-il Lee, Minbeom Kim, Seunghyun Yoon, Minsung Kim +3
2025-02-11
Computer Vision and Pattern Recognition · Computer Science
@Bench: Benchmarking Vision-Language Models for Human-centered Assistive Technology
Xin Jiang, Junwei Zheng, Ruiping Liu, Jiahang Li +3
2024-11-26
Computer Vision and Pattern Recognition · Computer Science
Benchmarking Image Retrieval for Visual Localization
Noé Pion, Martin Humenberger, Gabriela Csurka, Yohann Cabon +1
2020-12-02