Computer Vision and Pattern Recognition · Computer Science
AgroBench: Vision-Language Model Benchmark in Agriculture
Risa Shinoda, Nakamasa Inoue, Hirokatsu Kataoka, Masaki Onishi +1
2025-07-29
Computer Vision and Pattern Recognition · Computer Science
Can Large Multimodal Models Understand Agricultural Scenes? Benchmarking with AgroMind
Qingmei Li, Yang Zhang, Zurong Mai, Yuhang Chen +9
2025-08-14
Computation and Language · Computer Science
SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science
Jie Ying, Zihong Chen, Zhefan Wang, Wanli Jiang +6
2025-05-20
Computation and Language · Computer Science
AgriEval: A Comprehensive Chinese Agricultural Benchmark for Large Language Models
Lian Yan, Haotian Wang, Chen Tang, Haifeng Liu +4
2025-07-30
Computer Vision and Pattern Recognition · Computer Science
UrBench: A Comprehensive Benchmark for Evaluating Large Multimodal Models in Multi-View Urban Scenarios
Baichuan Zhou, Haote Yang, Dairong Chen, Junyan Ye +6
2025-03-11
Artificial Intelligence · Computer Science
AgriGPT: a Large Language Model Ecosystem for Agriculture
Bo Yang, Yu Zhang, Lanfei Feng, Yunkui Chen +9
2025-08-13
Instrumentation and Methods for Astrophysics · Physics
AstroMMBench: A Benchmark for Evaluating Multimodal Large Language Models Capabilities in Astronomy
Jinghang Shi, Xiaoyu Tang, Yang Huang, Yuyang Li +3
2025-10-22
Artificial Intelligence · Computer Science
MSEarth: A Multimodal Benchmark for Earth Science Phenomenon Discovery with MLLMs
Xiangyu Zhao, Wanghan Xu, Bo Liu, Yuhao Zhou +6
2026-05-05
Computer Vision and Pattern Recognition · Computer Science
MIBench: Evaluating Multimodal Large Language Models over Multiple Images
Haowei Liu, Xi Zhang, Haiyang Xu, Yaya Shi +7
2024-10-10
Computer Vision and Pattern Recognition · Computer Science
SurgMLLMBench: A Multimodal Large Language Model Benchmark Dataset for Surgical Scene Understanding
Tae-Min Choi, Tae Kyeong Jeong, Garam Kim, Jaemin Lee +5
2025-11-27
Computer Vision and Pattern Recognition · Computer Science
MuirBench: A Comprehensive Benchmark for Robust Multi-image Understanding
Fei Wang, Xingyu Fu, James Y. Huang, Zekun Li +17
2024-07-03
Machine Learning · Computer Science
LUCAS-MEGA: A Large-Scale Multimodal Dataset for Representation Learning in Soil-Environment Systems
Kuangdai Leng, Simon Jeffery, Panos Panagos, Tarje Nissen-Meyer
2026-05-11
Computer Vision and Pattern Recognition · Computer Science
MMLANDMARKS: a Cross-View Instance-Level Benchmark for Geo-Spatial Understanding
Oskar Kristoffersen, Alba Reinders Sánchez, Morten Rieger Hannemose, Anders Bjorholm Dahl +1
2026-04-29
Computer Vision and Pattern Recognition · Computer Science
MAgSeg: Segmentation of Agricultural Landscapes in High-Resolution Satellite Imagery using Multimodal Large Language Models
Piyush Tiwary, Utkarsh Ahuja, Depanshu Sani, Aishwarya Jayagopal +4
2026-05-18
Computer Vision and Pattern Recognition · Computer Science
Agri-LLaVA: Knowledge-Infused Large Multimodal Assistant on Agricultural Pests and Diseases
Liqiong Wang, Teng Jin, Jinyu Yang, Ales Leonardis +2
2024-12-05
Computation and Language · Computer Science
NutriBench: A Dataset for Evaluating Large Language Models on Nutrition Estimation from Meal Descriptions
Andong Hua, Mehak Preet Dhaliwal, Laya Pullela, Ryan Burke +1
2026-03-04
Computer Vision and Pattern Recognition · Computer Science
AgroTools: A Benchmark for Tool-Augmented Multimodal Agents in Agriculture
Zi Ye, Yibin Wen, Xiaoya Fan, Xinyu Zhang +9
2026-05-22
Computation and Language · Computer Science
MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages
Wenhan Han, Yifan Zhang, Zhixun Chen, Binbin Liu +6
2025-06-25
Computer Vision and Pattern Recognition · Computer Science
MMRareBench: A Rare-Disease Multimodal and Multi-Image Medical Benchmark
Junzhi Ning, Jiashi Lin, Yingying Fang, Wei Li +8
2026-05-14
Computer Vision and Pattern Recognition · Computer Science
AgriDoctor: A Multimodal Intelligent Assistant for Agriculture
Mingqing Zhang, Zhuoning Xu, Peijie Wang, Rongji Li +6
2025-09-23
Computer Vision and Pattern Recognition · Computer Science
All Languages Matter: Evaluating LMMs on Culturally Diverse 100 Languages
Ashmal Vayani, Dinura Dissanayake, Hasindri Watawana, Noor Ahsan +65
2025-05-02
Computer Vision and Pattern Recognition · Computer Science
INS-MMBench: A Comprehensive Benchmark for Evaluating LVLMs' Performance in Insurance
Chenwei Lin, Hanjia Lyu, Xian Xu, Jiebo Luo
2025-08-11
Machine Learning · Computer Science
MMSciBench: Benchmarking Language Models on Chinese Multimodal Scientific Problems
Xinwu Ye, Chengfan Li, Siming Chen, Wei Wei +1
2025-06-03
Computer Vision and Pattern Recognition · Computer Science
CAMEL-Bench: A Comprehensive Arabic LMM Benchmark
Sara Ghaboura, Ahmed Heakl, Omkar Thawakar, Ali Alharthi +6
2024-10-25