Advertisement

聚类:k均值和MapReduce

阅读量:

本内容源自coursera,如需转载,请注明出处。

本内容源自coursera,如需转载,请注明出处。

1.聚类——非监督学习的例子

聚类即指输入的数据未预先分配类别。因此在系统中我们会将数据导入到数据库中存储起来,并通过预设的算法模型进行分析判断最后输出结果。
然而这些限制表明,在某些情况下实际分类可能会变得模糊不清。

这里写图片描述

有些聚类形式很难发现:

这里写图片描述

2.聚类算法——k-means

算法流程:

  • 随机地确定聚类中心的初始位置;
    • 依据观测点与各聚类中心之间的距离远近程

全部评论 (0)

还没有任何评论哟~