中文

评估分类任务上的一致性:Kappa 统计量

cmp-lg 2008-02-03 v1 计算与语言

摘要

目前,在话语和对话领域从事研究的计算语言学家和认知科学家使用几种不同的统计量来论证其主观判断是可靠的,但这些统计量都难以解释或相互比较。与此同时,内容分析领域的研究人员已经经历了同样的困难,并提出了 Kappa 统计量作为解决方案。我们讨论了当前在计算语言学和认知科学的话语与对话工作中使用的可靠性度量的问题,并论证我们作为一个领域最好采用来自内容分析的技术。

关键词

引用

@article{arxiv.cmp-lg/9602004,
  title  = {Assessing agreement on classification tasks: the kappa statistic},
  author = {Jean Carletta},
  journal= {arXiv preprint arXiv:cmp-lg/9602004},
  year   = {2008}
}

备注

9 pages