Computer Vision and Pattern Recognition · Computer Science
Google Landmarks Dataset v2 -- A Large-Scale Benchmark for Instance-Level Recognition and Retrieval
Tobias Weyand, Andre Araujo, Bingyi Cao, Jack Sim
2020-11-03
Computer Vision and Pattern Recognition · Computer Science
Evaluating General Purpose Vision Foundation Models for Medical Image Analysis: An Experimental Study of DINOv2 on Radiology Benchmarks
Mohammed Baharoon, Waseem Qureshi, Jiahong Ouyang, Yanwu Xu +2
2024-09-17
Machine Learning · Computer Science
Codabench: Flexible, Easy-to-Use and Reproducible Benchmarking Platform
Zhen Xu, Sergio Escalera, Isabelle Guyon, Adrien Pavão +4
2022-06-28
Computer Vision and Pattern Recognition · Computer Science
MDPBench: A Benchmark for Multilingual Document Parsing in Real-World Scenarios
Zhang Li, Zhibo Lin, Qiang Liu, Ziyang Zhang +6
2026-03-31
Computer Vision and Pattern Recognition · Computer Science
OpenVTON-Bench: A Large-Scale High-Resolution Benchmark for Controllable Virtual Try-On Evaluation
Jin Li, Tao Chen, Shuai Jiang, Weijie Wang +2
2026-05-07
Computer Vision and Pattern Recognition · Computer Science
OmniDocBench: Benchmarking Diverse PDF Document Parsing with Comprehensive Annotations
Linke Ouyang, Yuan Qu, Hongbin Zhou, Jiawei Zhu +16
2025-03-26
Computation and Language · Computer Science
GlotOCR Bench: OCR Models Still Struggle Beyond a Handful of Unicode Scripts
Amir Hossein Kargaran, Nafiseh Nikeghbal, Jana Diesner, François Yvon +1
2026-04-15
Artificial Intelligence · Computer Science
WebRenderBench: Enhancing Web Interface Generation through Layout-Style Consistency and Reinforcement Learning
Peichao Lai, Jinhui Zhuang, Kexuan Zhang, Ningchang Xiong +5
2025-10-10
Computer Vision and Pattern Recognition · Computer Science
FastDINOv2: Frequency Based Curriculum Learning Improves Robustness and Training Speed
Jiaqi Zhang, Juntuo Wang, Zhixin Sun, John Zou +1
2026-01-30
Digital Libraries · Computer Science
RenoBench: A Citation Parsing Benchmark
Parth Sarin, Juan Pablo Alperin, Adam Buttrick, Dione Mentis
2026-03-27
Software Engineering · Computer Science
Code2Bench: Scaling Source and Rigor for Dynamic Benchmark Construction
Zhe Zhang, Runlin Liu, Aishan Liu, Xingyu Liu +2
2026-02-04
Computer Vision and Pattern Recognition · Computer Science
DINOv3 Beats Specialized Detectors: A Simple Foundation Model Baseline for Image Forensics
Jieming Yu, Qiuxiao Feng, Zhuohan Wang, Xiaochen Ma
2026-04-20
Computation and Language · Computer Science
YourBench: Easy Custom Evaluation Sets for Everyone
Sumuk Shashidhar, Clémentine Fourrier, Alina Lozovskia, Thomas Wolf +2
2025-04-03
Machine Learning · Computer Science
DevBench: A Realistic, Developer-Informed Benchmark for Code Generation Models
Adarsh Kumarappan, Pareesa Ameneh Golnari, Wen Wen, Xiaoyu Liu +4
2026-05-19
Computer Vision and Pattern Recognition · Computer Science
Reading $\neq$ Seeing: Diagnosing and Closing the Typography Gap in Vision-Language Models
Heng Zhou, Ao Yu, Li Kang, Yuchen Fan +4
2026-03-10
Computer Vision and Pattern Recognition · Computer Science
GEditBench v2: A Human-Aligned Benchmark for General Image Editing
Zhangqi Jiang, Zheng Sun, Xianfang Zeng, Yufeng Yang +6
2026-03-31
Computer Vision and Pattern Recognition · Computer Science
Towards Fine-Grained Recognition with Large Visual Language Models: Benchmark and Optimization Strategies
Cong Pang, Hongtao Yu, Zixuan Chen, Lewei Lu +1
2025-12-12
Computer Vision and Pattern Recognition · Computer Science
GeoBench: Benchmarking and Analyzing Monocular Geometry Estimation Models
Yongtao Ge, Guangkai Xu, Zhiyue Zhao, Libo Sun +4
2024-06-24
Computer Vision and Pattern Recognition · Computer Science
UniGenBench++: A Unified Semantic Evaluation Benchmark for Text-to-Image Generation
Yibin Wang, Zhimin Li, Yuhang Zang, Jiazi Bu +7
2026-02-25
Computer Vision and Pattern Recognition · Computer Science
How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings
Zhiheng Li, Zongyang Ma, Jiaxian Chen, Jianing Zhang +11
2026-05-11
Computation and Language · Computer Science
EvoCodeBench: An Evolving Code Generation Benchmark with Domain-Specific Evaluations
Jia Li, Ge Li, Xuanming Zhang, Yunfei Zhao +5
2024-10-31
Computational Engineering, Finance, and Science · Computer Science
FinLoRA: Benchmarking LoRA Methods for Fine-Tuning LLMs on Financial Datasets
Dannong Wang, Jaisal Patel, Daochen Zha, Steve Y. Yang +1
2025-05-27