中文

重复分类评分的统计模型:R 包 rater

统计方法学 2024-01-11 v5 统计计算

摘要

许多学科中的一个常见问题是需要将一组条目分配到具有已知标签的类别或类中。这通常由一个或多个专家评分者完成,有时也由自动化流程完成。如果这些分配或“评分”难以准确做出,一种常见策略是由不同评分者重复进行,甚至由同一评分者在不同场合多次进行。我们介绍一个已在 CRAN 上提供的 R 包“rater”,它实现了用于分析重复分类评分数据的若干统计模型的贝叶斯版本。可以对每个条目的真实潜在类别以及每位评分者的准确性进行推断。这些模型是对 Dawid-Skene 模型的扩展并包含了该模型,我们使用 Stan 概率编程语言实现它们。我们通过几个示例说明“rater”的使用。我们还详细讨论了边缘化与条件化技术,这些技术对这些模型是必要的,但也更普遍地适用于 Stan 中实现的其他模型。

关键词

引用

@article{arxiv.2010.09335,
  title  = {Statistical Models for Repeated Categorical Ratings: The R Package rater},
  author = {Jeffrey M. Pullin and Lyle C. Gurrin and Damjan Vukcevic},
  journal= {arXiv preprint arXiv:2010.09335},
  year   = {2024}
}

备注

26 pages, 10 figures. Updated to match the final published version. The version here also contains many improvements in the formatting of the tables and figures