聚类分析
发布时间
阅读量:
阅读量
基于社会学理论可知,在人类社会中存在多种群体划分方式。针对实际应用场景而言,在众多领域都面临着复杂的分类挑战。聚类分析不仅仅是一种数据处理手段还是一种多维度信息挖掘技术它广泛应用于生物学经济活动人口统计等领域
更多的MATLAB数据分析教学视频,请点击观看;亦可访问网易云课堂学习平台搜索课程《MATLAB数据分析与统计》 http://study.163.com/course/courseMain.htm?courseId=1003615016
进行聚类分析的目的在于将数据样本按照内在规律划分为若干个互不重叠且有明显特征的群体;无需预先设定类别数量或类型;无需假设各类的数量及其内部结构;在同类内部的数据样本之间具有较高的相似度,在不同类别中的样本则表现出较低程度的一致性
这里主要介绍K均值聚类和模糊C聚类
1.K均值聚类
K均值聚类被称为快速聚类法,并起源于麦奎因于1967年提出的这一聚类方法;该算法的主要步骤包括以下几个方面的内容。
第一:首先确定k个代表性的样本单元作为聚类中心(种子节点),其次可以选择将所有样本划分为k个初始簇;接着以每个簇内所有样本数据的均值向量作为聚类中心。
在第二阶段中,在排除所有已有的凝聚点的前提下,逐一对剩余的所有样本进行分类处理。具体而言,在每一轮迭代中, 系统会将每个样本分配到与其距离最近的那个凝聚点所属的类别中, 并根据当前该类别
全部评论 (0)
还没有任何评论哟~
