中文

在随机临床试验中利用高维数据:方法与实践综述

应用统计 2024-02-07 v2

摘要

引言:即使在有效开展的随机试验中,研究成功的概率仍然相对较低。随着下一代测序技术的最新进展,包括基因、分子和表型信息在内的高维数据迅速增加,这提高了我们对驱动基因、药物靶点和药物作用机制的理解。利用高维数据有望提高临床试验的成功率。方法:我们概述了在临床试验中利用高维数据的方法。我们还通过回顾近期发表的利用高维基因数据的随机临床试验,调查了这些方法在实践中的应用。该综述包括 2019 年至 2021 年间发表的文章,通过 PubMed 数据库识别。结果:在筛选的 174 篇文章中,有 100 篇 (57.5%) 是收集高维数据的随机临床试验。最常见的临床领域是肿瘤学 (30%),其次是慢性病 (28%)、营养与衰老 (18%) 和心血管疾病 (7%)。分析的最常见数据类型是基因表达数据 (70%),其次是 DNA 数据 (21%)。最常见的分析方法 (36.3%) 是单变量分析。描述多变量分析的文章使用了标准统计方法。大多数临床试验有两个试验组。讨论:为了更有效地分析随机临床试验中收集的日益增多的高维数据,需要新的方法学途径。我们强调了当前在试验中使用高维数据的局限性和障碍,并提出了改进和未来工作的潜在途径。

关键词

引用

@article{arxiv.2305.10174,
  title  = {Utilising high-dimensional data in randomised clinical trials: a review of methods and practice},
  author = {Svetlana Cherlin and Theophile Bigirumurame and Michael J Grayling and Jérémie Nsengimana and Luke Ouma and Aida Santaolalla and Fang Wan and S Faye Williamson and James M S Wason},
  journal= {arXiv preprint arXiv:2305.10174},
  year   = {2024}
}

备注

17 pages, 3 figures, 2 tables