机器学习4
发布时间
阅读量:
阅读量
支持向量机(SVM)被认为是机器学习领域中最强大的工具之一。不仅支持线性和非线性分类任务,同时也具备处理回归问题的能力。特别擅长识别异常数据点,并且能够有效地进行预测分析。该方法尤其适合涉及的数据集规模适中至稍大的情况下的分类任务。
一,线性SVM分类
(Linear SVM Classification)

观察下图,在左侧图表中可以看到目前分为两类数据。仅需一条直线即可将这两类数据区分开来。红、紫两条直线都能有效地将这两类数据区分开来,并且由于这两条直线都十分接近样本点,在新样本加入时存在较高的分类错误风险。
其核心思想是通过右图所示黑色实线来表示决策边界,在实现正确分类的同时尽可能远离那些边缘附近的样本。其中位于虚线上方或下方的所有样本即为支撑向量(support vectors)。因此,在没有其他任何数据点位于由这些支撑向量划分出的区域之间的情况下,决策边界将完全由它们所确定。
需要注意的是,在使用支持向量机(SVM)进行分类或回归任务时,模型会对不同特征之间的尺度关系非常敏感。归一化处理时通常采用的方法包括使用StandardScaler来进行数据标
全部评论 (0)
还没有任何评论哟~
