集成学习有哪些方法，各有什么特点？<br />-k6k4.com

集成学习有哪些方法，各有什么特点？

集成学习主要分为 bagging， boosting 和 stacking方法。

bagging方法：

给定一个大小为n的训练集 D，Bagging算法从中均匀、有放回地选出 m个大小为 n' 的子集Di，作为新的训练集。在这 m个训练集上使用分类、回归等算法，则可得到 m个模型，再通过取平均值、取多数票等方法综合产生预测结果，即可得到Bagging的结果。

boosting方法：

加入的过程中，通常根据它们的上一轮的分类准确率给予不同的权重。加和弱学习者之后，数据通常会被重新加权，来强化对之前分类错误数据点的分类，其中一个经典的提升算法例子是AdaBoost。

stacking方法：

将训练好的所有基模型对整个训练集进行预测，第j个基模型对第i个训练样本的预测值将作为新的训练集中第i个样本的第j个特征值，最后基于新的训练集进行训练。同理，预测的过程也要先经过所有基模型的预测形成新的测试集，最后再对测试集进行预测。

参考：

更多精选文章

标签：训练、bagging、stacking、预测、分类

笔试题

刷题

简历模板

AI算法

大数据

内推

内推：