Computation and Language · Computer Science
GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding
Alex Wang, Amanpreet Singh, Julian Michael, Felix Hill +2
2019-02-26
Computation and Language · Computer Science
CLUE: A Chinese Language Understanding Evaluation Benchmark
Liang Xu, Hai Hu, Xuanwei Zhang, Lu Li +28
2020-11-06
Computation and Language · Computer Science
LexGLUE: A Benchmark Dataset for Legal Language Understanding in English
Ilias Chalkidis, Abhik Jana, Dirk Hartung, Michael Bommarito +3
2022-11-09
Computation and Language · Computer Science
bgGLUE: A Bulgarian General Language Understanding Evaluation Benchmark
Momchil Hardalov, Pepa Atanasova, Todor Mihaylov, Galia Angelova +6
2023-06-08
Computation and Language · Computer Science
PLUE: Language Understanding Evaluation Benchmark for Privacy Policies in English
Jianfeng Chi, Wasi Uddin Ahmad, Yuan Tian, Kai-Wei Chang
2023-05-15
Computation and Language · Computer Science
Can Machines Read Coding Manuals Yet? -- A Benchmark for Building Better Language Models for Code Understanding
Ibrahim Abdelaziz, Julian Dolby, Jamie McCusker, Kavitha Srinivas
2021-09-16
Computation and Language · Computer Science
ltzGLUE: Luxembourgish General Language Understanding Evaluation
Alistair Plum, Felicia Körner, Anne-Marie Lutgen, Laura Bernardy +7
2026-04-21
Computation and Language · Computer Science
COLE: a Comprehensive Benchmark for French Language Understanding Evaluation
David Beauchemin, Yan Tremblay, Mohamed Amine Youssef, Richard Khoury
2025-10-08
Computation and Language · Computer Science
WHEN FLUE MEETS FLANG: Benchmarks and Large Pre-trained Language Model for Financial Domain
Raj Sanjay Shah, Kunal Chawla, Dheeraj Eidnani, Agam Shah +6
2022-11-02
Computation and Language · Computer Science
SuperGLUE: A Stickier Benchmark for General-Purpose Language Understanding Systems
Alex Wang, Yada Pruksachatkun, Nikita Nangia, Amanpreet Singh +4
2020-02-14
Computation and Language · Computer Science
XGLUE: A New Benchmark Dataset for Cross-lingual Pre-training, Understanding and Generation
Yaobo Liang, Nan Duan, Yeyun Gong, Ning Wu +20
2020-05-25
Computation and Language · Computer Science
VALUE: Understanding Dialect Disparity in NLU
Caleb Ziems, Jiaao Chen, Camille Harris, Jessica Anderson +1
2022-09-14
Computation and Language · Computer Science
Are Multilingual Models the Best Choice for Moderately Under-resourced Languages? A Comprehensive Assessment for Catalan
Jordi Armengol-Estapé, Casimiro Pio Carrino, Carlos Rodriguez-Penagos, Ona de Gibert Bonet +4
2021-07-19
Computation and Language · Computer Science
KLUE: Korean Language Understanding Evaluation
Sungjoon Park, Jihyung Moon, Sungdong Kim, Won Ik Cho +27
2021-11-03
Computation and Language · Computer Science
Spanish Pre-trained BERT Model and Evaluation Data
José Cañete, Gabriel Chaperon, Rodrigo Fuentes, Jou-Hui Ho +2
2023-08-08
Computation and Language · Computer Science
INCLUDE: Evaluating Multilingual Language Understanding with Regional Knowledge
Angelika Romanou, Negar Foroutan, Anna Sotnikova, Zeming Chen +55
2024-12-02
Computation and Language · Computer Science
New Semantic Task for the French Spoken Language Understanding MEDIA Benchmark
Nadège Alavoine, Gaëlle Laperriere, Christophe Servan, Sahar Ghannay +1
2024-04-01
Computation and Language · Computer Science
How Does Data Corruption Affect Natural Language Understanding Models? A Study on GLUE datasets
Aarne Talman, Marianna Apidianaki, Stergios Chatzikyriakidis, Jörg Tiedemann
2022-05-17
Computation and Language · Computer Science
NERCat: Fine-Tuning for Enhanced Named Entity Recognition in Catalan
Guillem Cadevall Ferreres, Marc Serrano Sanz, Marc Bardeli Gámez, Pol Gerdt Basullas +2
2025-03-19
Computation and Language · Computer Science
SLUE Phase-2: A Benchmark Suite of Diverse Spoken Language Understanding Tasks
Suwon Shon, Siddhant Arora, Chyi-Jiunn Lin, Ankita Pasad +6
2023-06-19
Computation and Language · Computer Science
KLEJ: Comprehensive Benchmark for Polish Language Understanding
Piotr Rybak, Robert Mroczkowski, Janusz Tracz, Ireneusz Gawlik
2020-05-05
Computation and Language · Computer Science
Benchmarking Natural Language Understanding Services for building Conversational Agents
Xingkun Liu, Arash Eshghi, Pawel Swietojanski, Verena Rieser
2019-03-27