【AI面试题】随机森林算法的原理、随机性、优缺点

1. 随机森林算法原理

       随机森林算法是Bagging集成框架下的一种算法,它同时对训练数据和特征采用随机抽样的方法来构建更加多样化的模型。随机森林具体的算法步骤如下:

1, 假设有N个样本,则有放回的随机选择N个样本(每次随机选择一个样本,然后将该样本放回并继续选择)。采用选择好的N个样本用来训练一个决策树,作为决策树根节点处的样本。
2. 假设每个样本有M个属性,在决策树做节点分裂时,随机从这M个属性中选取m个属性,满足条件 m << M 。然后采用某种策略(比如信息增益最大化)从m个属性中选择一个最优属性作为该节点的分类属性。
3. 决策树形成过程中重复步骤2来计算和分裂节点。一直到节点不能够再分裂,或者达到设置好的阈值(比如树的深度,叶子节点的数量等)为止。注意整个决策树形成过程中没有进行剪枝。
4. 重复步骤1~3建立大量的决策树,这样就构成了随机森林。

在这里插入图片描述

2. 随机森林的随机性体现在哪里

       随机森林的随机性体现在每棵树的训练样本是随机的,树中每个节点的分裂属性集合也是随机选择确定的,如下:
(1)随机采样:随机森林在

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值