使用不同聚类技术探究乳腺癌数据集的相关性
机器学习
2021-09-06 v1
摘要
本文的目标是在无先验训练模型的无监督学习背景下探索分析乳腺癌数据集的方法。本文研究了不同的聚类技术以及预处理方法。这一深入分析构建了可进一步用于设计最鲁棒且准确的医学预后系统的基石。本文还着重关注数据点与使用不同标准基准技术的相关性。关键词:乳腺癌数据集,聚类技术,Hopkins 统计量,K-means 聚类,k-medoids 或围绕 medoids 划分 (PAM)
引用
@article{arxiv.2109.01538,
title = {Investigate the Correlation of Breast Cancer Dataset using Different Clustering Technique},
author = {Somenath Chakraborty and Beddhu Murali},
journal= {arXiv preprint arXiv:2109.01538},
year = {2021}
}