Computation and Language · Computer Science
AC-EVAL: Evaluating Ancient Chinese Language Understanding in Large Language Models
Yuting Wei, Yuanxing Xu, Xinru Wei, Simin Yang +4
2024-03-12
Computation and Language · Computer Science
CMMLU: Measuring massive multitask language understanding in Chinese
Haonan Li, Yixuan Zhang, Fajri Koto, Yifei Yang +4
2024-01-19
Computation and Language · Computer Science
C$^{3}$Bench: A Comprehensive Classical Chinese Understanding Benchmark for Large Language Models
Jiahuan Cao, Yongxin Shi, Dezhi Peng, Yang Liu +1
2024-05-31
Computation and Language · Computer Science
F\`ux\`i: A Benchmark for Evaluating Language Models on Ancient Chinese Text Understanding and Generation
Shangqing Zhao, Yuhao Zhou, Yupei Ren, Zhe Chen +5
2025-03-21
Computation and Language · Computer Science
Benchmarking Large Language Models on CFLUE -- A Chinese Financial Language Understanding Evaluation Dataset
Jie Zhu, Junhui Li, Yalong Wen, Lifan Guo
2024-05-20
Computation and Language · Computer Science
CLUE: A Chinese Language Understanding Evaluation Benchmark
Liang Xu, Hai Hu, Xuanwei Zhang, Lu Li +28
2020-11-06
Computation and Language · Computer Science
TongGu: Mastering Classical Chinese Understanding with Knowledge-Grounded Large Language Models
Jiahuan Cao, Dezhi Peng, Peirong Zhang, Yongxin Shi +3
2024-10-01
Computation and Language · Computer Science
SuperCLUE: A Comprehensive Chinese Large Language Model Benchmark
Liang Xu, Anqi Li, Lei Zhu, Hang Xue +6
2023-07-28
Computation and Language · Computer Science
An Improved Traditional Chinese Evaluation Suite for Foundation Model
Zhi-Rui Tam, Ya-Ting Pai, Yen-Wei Lee, Jun-Da Chen +3
2024-07-12
Computation and Language · Computer Science
AncientBench: Towards Comprehensive Evaluation on Excavated and Transmitted Chinese Corpora
Zhihan Zhou, Daqian Shi, Rui Song, Lida Shi +2
2025-12-22
Computation and Language · Computer Science
ArcMMLU: A Library and Information Science Benchmark for Large Language Models
Shitou Zhang, Zuchao Li, Xingshen Liu, Liming Yang +1
2023-12-01
Computation and Language · Computer Science
TCM-3CEval: A Triaxial Benchmark for Assessing Responses from Large Language Models in Traditional Chinese Medicine
Tianai Huang, Lu Lu, Jiayuan Chen, Lihao Liu +4
2025-03-11
Computation and Language · Computer Science
ExplainCPE: A Free-text Explanation Benchmark of Chinese Pharmacist Examination
Dongfang Li, Jindi Yu, Baotian Hu, Zhenran Xu +1
2023-10-27
Computation and Language · Computer Science
AlignBench: Benchmarking Chinese Alignment of Large Language Models
Xiao Liu, Xuanyu Lei, Shengyuan Wang, Yue Huang +14
2024-08-27
Computation and Language · Computer Science
LOT: A Story-Centric Benchmark for Evaluating Chinese Long Text Understanding and Generation
Jian Guan, Zhuoer Feng, Yamei Chen, Ruilin He +3
2022-01-19
Computation and Language · Computer Science
CLongEval: A Chinese Benchmark for Evaluating Long-Context Large Language Models
Zexuan Qiu, Jingjing Li, Shijue Huang, Xiaoqi Jiao +2
2024-10-17
Computation and Language · Computer Science
PromptCBLUE: A Chinese Prompt Tuning Benchmark for the Medical Domain
Wei Zhu, Xiaoling Wang, Huanran Zheng, Mosha Chen +1
2023-10-24
Computation and Language · Computer Science
Benchmarking Vision-Language Models on Chinese Ancient Documents: From OCR to Knowledge Reasoning
Haiyang Yu, Yuchuan Wu, Fan Shi, Lei Liao +17
2025-09-15
Computation and Language · Computer Science
On the (In)Effectiveness of Large Language Models for Chinese Text Correction
Yinghui Li, Haojing Huang, Shirong Ma, Yong Jiang +4
2024-10-28
Computation and Language · Computer Science
CLEVA: Chinese Language Models EVAluation Platform
Yanyang Li, Jianqiao Zhao, Duo Zheng, Zi-Yuan Hu +7
2023-10-17
Computation and Language · Computer Science
CLaw: Benchmarking Chinese Legal Knowledge in Large Language Models - A Fine-grained Corpus and Reasoning Analysis
Xinzhe Xu, Liang Zhao, Hongshen Xu, Chen Chen
2025-09-26
Computation and Language · Computer Science
Measuring Taiwanese Mandarin Language Understanding
Po-Heng Chen, Sijia Cheng, Wei-Lin Chen, Yen-Ting Lin +1
2024-04-01
Computation and Language · Computer Science
Measuring Hong Kong Massive Multi-Task Language Understanding
Chuxue Cao, Zhenghao Zhu, Junqi Zhu, Guoying Lu +5
2025-05-06
Computation and Language · Computer Science
TLUE: A Tibetan Language Understanding Evaluation Benchmark
Fan Gao, Cheng Huang, Nyima Tashi, Xiangxiang Wang +8
2025-10-03