针对不平衡数据集的Bagging改进算法  被引量:12

Improving Bagging algorithm for imbalance data

在线阅读下载全文

作  者:李明方[1] 张化祥[1] 

机构地区:[1]山东师范大学信息科学与工程学院,济南250014

出  处:《计算机工程与应用》2010年第30期40-42,共3页Computer Engineering and Applications

基  金:山东省高新技术自主创新工程专项计划(No.2007ZZ17);山东省自然科学基金No.Y2007G16;山东省科技攻关计划No.2008GG10001015;山东省电子发展基金(No.2008B0026)~~

摘  要:传统的Bagging分类方法对不平衡数据集进行分类时,虽然能够达到很高的分类精度,但是对其中少数类的分类准确率不高。为提高其对少数类数据的分类精度,利用SMOTE算法对样例集中的少数类样例进行加工,在Bagging算法中根据类值对各个样例的权重进行调整。混淆矩阵和ROC曲线表明改进算法达到了既能保证整体的分类准确率,又能提高少数类分类精度的目的。The traditional Bagging method can achieve a high accuracy for imbalance data,but gets low accuracy of the minority class samples.In order to improve the accuracy of the minority class samples with Bagging algorithm,the paper proposes a two-step approach.Firstly,SMOTE algorithm is used to increase the number of the minority class samples and then adjusts the weight for each instance in Bagging according to its class value.Results of the confusing matrix and the ROC show the approach improves not only the classification performance of data as a whole but also that of the minority part.

关 键 词:不平衡类 少类样本合成过采样技术(SMOTE) BAGGING算法 权重 受试者工作特征曲线(ROC) 

分 类 号:TP391[自动化与计算机技术—计算机应用技术]

 

参考文献:

正在载入数据...

 

二级参考文献:

正在载入数据...

 

耦合文献:

正在载入数据...

 

引证文献:

正在载入数据...

 

二级引证文献:

正在载入数据...

 

同被引文献:

正在载入数据...

 

相关期刊文献:

正在载入数据...

相关的主题
相关的作者对象
相关的机构对象