上传者: 38555019
|
上传时间: 2022-04-16 10:32:41
|
文件大小: 90KB
|
文件类型: PDF
前言
优化随机森林算法,正确率提高1%~5%(已经有90%+的正确率,再调高会导致过拟合)
论文当然是参考的,毕竟出现早的算法都被人研究烂了,什么优化基本都做过。而人类最高明之处就是懂得利用前人总结的经验和制造的工具(说了这么多就是为偷懒找借口。hhhh)
优化思路
1. 计算传统模型准确率
2. 计算设定树木颗数时最佳树深度,以最佳深度重新生成随机森林
3. 计算新生成森林中每棵树的AUC,选取AUC靠前的一定百分比的树
4. 通过计算各个树的数据相似度,排除相似度超过设定值且AUC较小的树
5. 计算最终的准确率
主要代码粘贴如下(注释比较详细,就不介绍代码了)
#-*- c