t-SNE 会夸大簇的效果,可被证明
机器学习
2026-03-03 v2
摘要
t 分布随机邻居嵌入(t-SNE)广泛使用的核心信念是其生成的可视化结构大致匹配输入数据的结构。相反地,我们证明了:(1) 输入数据聚类的强度,和 (2) 离群点(outlier)的极端程度,都不能可靠地从 t-SNE 输出中推断出来。我们在实际中演示了这些失效模式的普遍存在。
引用
@article{arxiv.2510.07746,
title = {t-SNE Exaggerates Clusters, Provably},
author = {Noah Bergam and Szymon Snoeck and Nakul Verma},
journal= {arXiv preprint arXiv:2510.07746},
year = {2026}
}
备注
ICLR 2026