Machine Learning · Computer Science
Sentiment Analysis in SemEval: A Review of Sentiment Identification Approaches
Bousselham El Haddaoui, Raddouane Chiheb, Rdouan Faizi, Abdellatif El Afia
2025-03-14
Computation and Language · Computer Science
EvEval: A Comprehensive Evaluation of Event Semantics for Large Language Models
Zhengwei Tao, Zhi Jin, Xiaoying Bai, Haiyan Zhao +3
2023-05-25
Computation and Language · Computer Science
SemEval 2023 Task 6: LegalEval - Understanding Legal Texts
Ashutosh Modi, Prathamesh Kalamkar, Saurabh Karn, Aman Tiwari +5
2023-05-02
Computation and Language · Computer Science
SuperTweetEval: A Challenging, Unified and Heterogeneous Benchmark for Social Media NLP Research
Dimosthenis Antypas, Asahi Ushio, Francesco Barbieri, Leonardo Neves +4
2023-10-24
Computation and Language · Computer Science
What are the best systems? New perspectives on NLP Benchmarking
Pierre Colombo, Nathan Noiry, Ekhine Irurozki, Stephan Clemencon
2022-10-10
Artificial Intelligence · Computer Science
LLMEval: A Preliminary Study on How to Evaluate Large Language Models
Yue Zhang, Ming Zhang, Haipeng Yuan, Shichun Liu +4
2023-12-19
Computation and Language · Computer Science
SemEval-2021 Task 11: NLPContributionGraph -- Structuring Scholarly NLP Contributions for a Research Knowledge Graph
Jennifer D'Souza, Sören Auer, Ted Pedersen
2021-10-18
Computation and Language · Computer Science
Evaluating Evaluation Metrics: A Framework for Analyzing NLG Evaluation Metrics using Measurement Theory
Ziang Xiao, Susu Zhang, Vivian Lai, Q. Vera Liao
2023-10-24
Computation and Language · Computer Science
Nonet at SemEval-2023 Task 6: Methodologies for Legal Evaluation
Shubham Kumar Nigam, Aniket Deroy, Noel Shallum, Ayush Kumar Mishra +5
2023-10-18
Computation and Language · Computer Science
Establishing Trustworthiness: Rethinking Tasks and Model Evaluation
Robert Litschko, Max Müller-Eberstein, Rob van der Goot, Leon Weber +1
2023-10-24
Computation and Language · Computer Science
A Survey on Evaluation of Large Language Models
Yupeng Chang, Xu Wang, Jindong Wang, Yuan Wu +12
2024-01-01
Computation and Language · Computer Science
EntEval: A Holistic Evaluation Benchmark for Entity Representations
Mingda Chen, Zewei Chu, Yang Chen, Karl Stratos +1
2019-11-12
Computation and Language · Computer Science
TMLab SRPOL at SemEval-2019 Task 8: Fact Checking in Community Question Answering Forums
Piotr Niewinski, Aleksander Wawer, Maria Pszona, Maria Janicka
2019-06-05
Computation and Language · Computer Science
SurveyEval: Towards Comprehensive Evaluation of LLM-Generated Academic Surveys
Jiahao Zhao, Shuaixing Zhang, Nan Xu, Lei Wang
2025-12-03
Artificial Intelligence · Computer Science
Sattiy at SemEval-2021 Task 9: An Ensemble Solution for Statement Verification and Evidence Finding with Tables
Xiaoyi Ruan, Meizhi Jin, Jian Ma, Haiqin Yang +3
2021-06-08