摘要:
关键参数 最重要的,常常需要调试以提高算法效果的有两个参数:numTrees,maxDepth。 numTrees(决策树的个数):增加决策树的个数会降低预测结果的方差,这样在测试时会有更高的accuracy。训练时间大致与numTrees呈线性增长关系。 maxDepth:是指森林中每一棵决策树最 阅读全文
posted @ 2017-07-19 09:46
bonelee
阅读(2262)
评论(0)
推荐(0)
摘要:
随机森林算法 由多个决策树构成的森林,算法分类结果由这些决策树投票得到,决策树在生成的过程当中分别在行方向和列方向上添加随机过程,行方向上构建决策树时采用放回抽样(bootstraping)得到训练数据,列方向上采用无放回随机抽样得到特征子集,并据此得到其最优切分点,这便是随机森林算法的基本原理。图 阅读全文
posted @ 2017-07-19 09:18
bonelee
阅读(9035)
评论(0)
推荐(0)

浙公网安备 33010602011771号