稠密核矩阵在近线性计算复杂度下的压缩、求逆与近似主成分分析
数值分析
2020-11-03 v5 计算复杂性
数据结构与算法
数值分析
概率论
摘要
由协方差函数在位置上的点赋值得到的稠密核矩阵出现在统计学、机器学习和数值分析中。对于作为椭圆边值问题格林函数的协方差函数和均匀分布的采样点,我们展示了如何识别一个子集,满足,使得稀疏矩阵的零填充不完全Cholesky分解是的一个-近似。该分解可在空间复杂度和时间复杂度内可证明地获得,改进了针对一般椭圆算子的现有技术水平;我们进一步提供了数值证据,表明可以取为数据集的内蕴维度而非环境空间的维度。该算法仅需知道的空间配置,不需要的解析表示。此外,该分解直接提供了一种在算子范数下具有最优收敛速度的近似稀疏主成分分析。因此,仅通过使用子采样和不完全Cholesky分解,我们便以近线性复杂度获得了一大类协方差矩阵的压缩、求逆和近似主成分分析。通过反转Cholesky分解的顺序,我们还获得了一个椭圆偏微分方程求解器,其空间复杂度为,时间复杂度为,改进了针对一般椭圆算子的现有技术水平。
引用
@article{arxiv.1706.02205,
title = {Compression, inversion, and approximate PCA of dense kernel matrices at near-linear computational complexity},
author = {Florian Schäfer and T. J. Sullivan and Houman Owhadi},
journal= {arXiv preprint arXiv:1706.02205},
year = {2020}
}
备注
52 pages. A high level summary of this work can be found under https://f-t-s.github.io/projects/cholesky/