|
计算机科学 2010
面向结构稳定性的分裂-合并聚类算法Keywords: 聚类算法,变体混合模型,结构稳定性,分裂-合并 Abstract: 聚类是在假设数据具有某种群聚结构的前提下根据观察到的无标记样本发现数据的最优划分。现有的聚类算法通常简单地导出假设结构和给定先验下最优或较优的聚类结果,体现为算法对样本分布拟合度的迭代最优化,即算法有效性。实际上,聚类的有效性取决于结构有效性、算法有效性和先验有效性3个方面的因素。基于这种考虑,提出了一种变体混合模型的聚类结构假设,以及判定聚类结构的稳定性的度量和方法,在算法有效的前提下通过单簇的分裂与合并来改进聚类结构的稳定性,并得到最终聚类结果,设计并实现了smclus聚类算法,通过对模拟数据和真实数据的聚类实验,例证了方法的有效性。
|