临床语言理解评测(CLUE)
计算与语言
2022-09-30 v1
摘要
临床语言处理近年来受到大量关注,催生了用于疾病表型分析、死亡率预测等任务的新模型或方法。遗憾的是,许多这些方法在不同的实验设置(例如数据源、训练与测试划分、度量指标、评估标准等)下进行测试,使得方法间难以比较并确定最先进水平。为解决这些问题并促进可复现性与比较,我们提出了临床语言理解评测(CLUE)基准,包含一组四项临床语言理解任务、源自MIMIC数据的标准训练、开发、验证和测试集,以及一个软件工具包。我们希望这些数据能够实现方法间的直接比较、改善可复现性,并降低为这些临床语言理解任务开发新模型或方法的门槛。
引用
@article{arxiv.2209.14377,
title = {Clinical Language Understanding Evaluation (CLUE)},
author = {Travis R. Goodwin and Dina Demner-Fushman},
journal= {arXiv preprint arXiv:2209.14377},
year = {2022}
}
备注
8 pages