Computation and Language · Computer Science
How to Evaluate Your Dialogue Models: A Review of Approaches
Xinmeng Li, Wansen Wu, Long Qin, Quanjun Yin
2021-08-04
Computation and Language · Computer Science
DynaEval: Unifying Turn and Dialogue Level Evaluation
Chen Zhang, Yiming Chen, Luis Fernando D'Haro, Yan Zhang +3
2021-06-08
Computation and Language · Computer Science
Achieving Reliable Human Assessment of Open-Domain Dialogue Systems
Tianbo Ji, Yvette Graham, Gareth J. F. Jones, Chenyang Lyu +1
2022-03-14
Computation and Language · Computer Science
SelF-Eval: Self-supervised Fine-grained Dialogue Evaluation
Longxuan Ma, Ziyu Zhuang, Weinan Zhang, Mingda Li +1
2022-09-19
Computation and Language · Computer Science
Learning an Efficient Multi-Turn Dialogue Evaluator from Multiple LLM Judges
Yuqi Tang, Kehua Feng, Yunfeng Wang, Zhiwen Chen +5
2026-01-07
Computation and Language · Computer Science
FineD-Eval: Fine-grained Automatic Dialogue-Level Evaluation
Chen Zhang, Luis Fernando D'Haro, Qiquan Zhang, Thomas Friedrichs +1
2022-11-01
Computation and Language · Computer Science
User Response and Sentiment Prediction for Automatic Dialogue Evaluation
Sarik Ghazarian, Behnam Hedayatnia, Alexandros Papangelis, Yang Liu +1
2022-02-18
Computation and Language · Computer Science
Toward More Accurate and Generalizable Evaluation Metrics for Task-Oriented Dialogs
Abishek Komma, Nagesh Panyam Chandrasekarasastry, Timothy Leffel, Anuj Goyal +3
2024-06-26
Computation and Language · Computer Science
How to Evaluate the Next System: Automatic Dialogue Evaluation from the Perspective of Continual Learning
Lu Li, Zhongheng He, Xiangyang Zhou, Dianhai Yu
2019-12-11
Computation and Language · Computer Science
DiQAD: A Benchmark Dataset for End-to-End Open-domain Dialogue Assessment
Yukun Zhao, Lingyong Yan, Weiwei Sun, Chong Meng +4
2023-10-26
Computation and Language · Computer Science
Survey on Evaluation Methods for Dialogue Systems
Jan Deriu, Alvaro Rodrigo, Arantxa Otegi, Guillermo Echegoyen +3
2020-06-29
Computation and Language · Computer Science
FlowEval: A Consensus-Based Dialogue Evaluation Framework Using Segment Act Flows
Jianqiao Zhao, Yanyang Li, Wanyu Du, Yangfeng Ji +3
2022-11-04
Computation and Language · Computer Science
Predictive Engagement: An Efficient Metric For Automatic Evaluation of Open-Domain Dialogue Systems
Sarik Ghazarian, Ralph Weischedel, Aram Galstyan, Nanyun Peng
2020-01-27
Computation and Language · Computer Science
xDial-Eval: A Multilingual Open-Domain Dialogue Evaluation Benchmark
Chen Zhang, Luis Fernando D'Haro, Chengguang Tang, Ke Shi +2
2023-10-16
Computation and Language · Computer Science
Is Your Goal-Oriented Dialog Model Performing Really Well? Empirical Analysis of System-wise Evaluation
Ryuichi Takanobu, Qi Zhu, Jinchao Li, Baolin Peng +2
2020-05-18
Computation and Language · Computer Science
Towards Coherent and Engaging Spoken Dialog Response Generation Using Automatic Conversation Evaluators
Sanghyun Yi, Rahul Goel, Chandra Khatri, Alessandra Cervone +5
2019-11-25
Computation and Language · Computer Science
What is wrong with you?: Leveraging User Sentiment for Automatic Dialog Evaluation
Sarik Ghazarian, Behnam Hedayatnia, Alexandros Papangelis, Yang Liu +1
2022-03-29
Computation and Language · Computer Science
Filtering Noisy Dialogue Corpora by Connectivity and Content Relatedness
Reina Akama, Sho Yokoi, Jun Suzuki, Kentaro Inui
2020-10-07
Computation and Language · Computer Science
EMO-Reasoning: Benchmarking Emotional Reasoning Capabilities in Spoken Dialogue Systems
Jingwen Liu, Kan Jen Cheng, Jiachen Lian, Akshay Anand +7
2025-08-27
Machine Learning · Computer Science
Domain-Independent turn-level Dialogue Quality Evaluation via User Satisfaction Estimation
Praveen Kumar Bodigutla, Longshaokan Wang, Kate Ridgeway, Joshua Levy +3
2019-08-21