因妊娠识别方法导致使用真实世界数据研究产前暴露的偏倚
应用统计
2025-04-18 v1
摘要
背景:研究人员通常基于观察到的结局(例如分娩)在医疗数据中识别妊娠。这种基于结局的方法会遗漏那些接受了产前护理但结局未被记录的妊娠(例如家中流产),从而可能在产前暴露的效应估计中引入选择偏倚。或者,可以使用产前就诊记录来识别妊娠,包括那些结局未被观察到的妊娠。然而,这种产前方法需要采用方法来处理缺失数据。方法:我们模拟了 10,000,000 例妊娠,并估计了开始治疗对子痫前期风险的总体效应。我们针对 36 种情景生成了数据,在这些情景中,我们改变了治疗对流产和/或子痫前期的影响;结局缺失的百分比(5% 或 20%);以及缺失的原因:(1)已测量的协变量,(2)未观察到的流产,以及(3)两者的混合。然后,我们创建了三个分析样本来处理妊娠结局缺失:观察到的分娩、观察到的分娩和流产,以及所有妊娠。使用非参数直接标准化法估计治疗效应。结果:当所有缺失均由未观察到的流产导致时,三个分析样本的风险差和风险比存在相似的偏倚(对数转换 RR 偏倚范围:观察到的分娩中为 -0.12-0.33;观察到的分娩和流产中为 -0.11-0.32;所有妊娠中为 -0.11-0.32)。当测量了缺失的预测变量时,仅所有妊娠方法是无偏的(分别为 -0.27-0.33;-0.29-0.03;和 -0.02-0.01)。结论:当所有缺失均由流产导致时,各分析样本返回了相似的效应估计。仅在所有妊娠中,随着由已测量变量导致的缺失比例增加,偏倚有所降低。
引用
@article{arxiv.2504.12415,
title = {Bias in studies of prenatal exposures using real-world data due to pregnancy identification method},
author = {Chase D. Latour and Jessie K. Edwards and Michele Jonsson Funk and Elizabeth A. Suarez and Kim Boggess and Mollie E. Wood},
journal= {arXiv preprint arXiv:2504.12415},
year = {2025}
}