Advertisement

了解 随机 森林 算法 的 基础 知识

阅读量:

文章目录

    • 随机 forests 的基本概念
  • random forests 的具体步骤
  • random forests 中有两个重要的超参数:
  • 该方法的优势在于其强大的预测能力
  • 该模型的主要缺点是计算资源需求较高
  • 我们需要理解为何 random forests 使用有放回的抽样方法?

随机森林简介

随机森林主要由多个层次的决策树构成,在每个节点上进行分裂的过程中引入了一定程度的空间重采样策略。
基于基学习器为单棵决策树以及采用样本空间重采样的机制,在构建每一棵子树时采用了属性维度上的随机化策略。
该方法显著提升了模型在新样本分类任务中的准确性。

随机森林的步骤

  • 首先,在样本数据集中有放回地随机抽取多个子样本集。
    • 其次,在候选特征集中随机选取k个关键指标作为当前节点下的分裂依据。
    • 最后,在完成所有决策树模型的构建后,

备注说明:
(1)随机森林的方法不仅从训练样本中进行抽样,并且也从特征中进行抽样;充分保证了每个树之间具有显著的不同之处;从而使得投票结果更加可靠。

在这里插入图片描述

(2)随机森林中的随机性

全部评论 (0)

还没有任何评论哟~