作为控制已测与未测疾病风险因素混杂方法的率标准化的一般表述
应用统计
2008-11-13 v1
摘要
标准化是控制群体研究或疾病登记数据中混杂因素的常用方法,被定义为各层别特异率的加权平均值。通常,关于构建特定标准化率的讨论将各层视为固定的,并侧重于影响权重设定的考量。每年来自 SEER 癌症登记处的数据都使用一种被称为“年龄直接标准化”的加权程序进行分析。为了评估直接标准化的性能,我们定义了一般类的标准化算子。我们将特定的标准化率视为算子和给定数据集的输出。基于算子的函数形式,我们定义了一类通过已测风险因素控制混杂的标准化算子子类。使用基本疾病概率范式进行推断,我们确立了在存在未测癌症风险因素的情况下,从这些算子产生的标准化率的逐年对比中可以得出的结论。这些结论表现为证伪关于给定所有风险因素(已测和未测)时疾病的条件概率,以及给定已测风险因素时未测风险因素的条件概率的特定假设。我们展示了这些证伪与从每年《国家癌症现状年度报告》中报告的直接标准化率对比中作出的推断之间的一一对应关系。
引用
@article{arxiv.0811.1842,
title = {A General formulation for standardization of rates as a method to control confounding by measured and unmeasured disease risk factors},
author = {Steven D. Mark},
journal= {arXiv preprint arXiv:0811.1842},
year = {2008}
}
备注
Published in at http://dx.doi.org/10.1214/08-AOAS170 the Annals of Applied Statistics (http://www.imstat.org/aoas/) by the Institute of Mathematical Statistics (http://www.imstat.org)