通过 AI 赋能临床试验设计:PowerGPT 的随机评估
人工智能
2025-09-17 v1
摘要
用于功效分析的样本量计算对临床研究和试验设计至关重要,然而其复杂性及对统计学专业知识的依赖为许多研究者构成了障碍。我们引入了 PowerGPT,这是一个将大语言模型(LLM)与统计引擎相结合的 AI 驱动系统,可自动完成试验设计中的检验选择和样本量估计。在一项评估其有效性的随机试验中,PowerGPT 显著提高了任务完成率(检验选择为 99.3% 对 88.9%,样本量计算为 99.3% 对 77.8%)和准确率(样本量估计为 94.1% 对 55.4%,p < 0.001),同时缩短了平均完成时间(4.0 对 9.3 分钟,p < 0.001)。这些提升在各种统计检验中均保持一致,不仅使统计学家和非统计学家均能受益,还弥合了专业知识差距。PowerGPT 现已在多家机构部署使用,代表了一种可扩展的 AI 驱动方法,可提升临床研究中统计功效分析的可及性、效率和准确性。
引用
@article{arxiv.2509.12471,
title = {Empowering Clinical Trial Design through AI: A Randomized Evaluation of PowerGPT},
author = {Yiwen Lu and Lu Li and Dazheng Zhang and Xinyao Jian and Tingyin Wang and Siqi Chen and Yuqing Lei and Jiayi Tong and Zhaohan Xi and Haitao Chu and Chongliang Luo and Alexis Ogdie and Brian Athey and Alparslan Turan and Michael Abramoff and Joseph C Cappelleri and Hua Xu and Yun Lu and Jesse Berlin and Daniel I. Sessler and David A. Asch and Xiaoqian Jiang and Yong Chen},
journal= {arXiv preprint arXiv:2509.12471},
year = {2025}
}