中文

基于非参数图模型的假发现率控制

计算机视觉与模式识别 2025-07-01 v1 人工智能

摘要

我们提出了针对多个假设检验中假发现率控制的充分条件和高效计算程序,适用于p值遵循已知\emph{依赖图}的情况——即我们假设p值在彼此邻居范围内独立,但其他依赖关系保持未指定状态。我们的方法的拒绝集合在依赖图中无边的情形下与Benjamini-Hochberg (BH)程序的拒绝集合一致;在模拟和基因组学数据示例中,我们发现当存在少数此类边时(此类情况在实际中常见),其功效接近BH程序。由于我们的方法忽略了不在BH拒绝集中的所有假设,因此只要该拒绝集较小,即可实现计算效率。我们最快的方法——IndBH程序——即使在包含百万个假设的模拟中,也通常在数秒内完成。

关键词

引用

@article{arxiv.2506.24125,
  title  = {FADRM: Fast and Accurate Data Residual Matching for Dataset Distillation},
  author = {Jiacheng Cui and Xinyue Bi and Yaxin Luo and Xiaohan Zhao and Jiacheng Liu and Zhiqiang Shen},
  journal= {arXiv preprint arXiv:2506.24125},
  year   = {2025}
}

备注

Code at: https://github.com/Jiacheng8/FADRM