了解 随机 森林 算法 的 基础 知识
发布时间
阅读量:
阅读量
文章目录
-
- 随机 forests 的基本概念
- random forests 的具体步骤
- random forests 中有两个重要的超参数:
- 该方法的优势在于其强大的预测能力
- 该模型的主要缺点是计算资源需求较高
- 我们需要理解为何 random forests 使用有放回的抽样方法?
随机森林简介
随机森林主要由多个层次的决策树构成,在每个节点上进行分裂的过程中引入了一定程度的空间重采样策略。
基于基学习器为单棵决策树以及采用样本空间重采样的机制,在构建每一棵子树时采用了属性维度上的随机化策略。
该方法显著提升了模型在新样本分类任务中的准确性。
随机森林的步骤
- 首先,在样本数据集中有放回地随机抽取多个子样本集。
- 其次,在候选特征集中随机选取k个关键指标作为当前节点下的分裂依据。
- 最后,在完成所有决策树模型的构建后,
备注说明:
(1)随机森林的方法不仅从训练样本中进行抽样,并且也从特征中进行抽样;充分保证了每个树之间具有显著的不同之处;从而使得投票结果更加可靠。

(2)随机森林中的随机性
全部评论 (0)
还没有任何评论哟~
