大规模数据集中星系的空间聚类
计算复杂性
2009-11-30 v2
摘要
包含数百万星系的数据集为空间聚类分析带来了新挑战。我们构建了一个集成对象目录、用于创建坏区域遮罩的工具以及快速 (NlogN) 关联代码的数据库框架。该系统使我们能够在 SDSS 目录上进行星系聚类分析的效率实现了空前的提升。类似的方法用于计算在 very large scales 上的三维星系空间聚类。我们描述了使用数据库来估计光度误差效应的策略。我们讨论了将其作为数据密集型科学的早期示例的努力。虽然在没有该框架的情况下也可能获得这些结果,但在未来的巨大数据集上进行这些计算将不可行。
引用
@article{arxiv.cs/0208018,
title = {Does P = NP?},
author = {C. Sauerbier},
journal= {arXiv preprint arXiv:cs/0208018},
year = {2009}
}
备注
withdrawn. It was a rediculously stupid notion