基于一种新的属性选择标准的ID3改进算法  被引量:11

Improved ID3 algorithm based on new attributes selection criterion

在线阅读下载全文

作  者:喻金平[1] 黄细妹[1] 李康顺[1,2] 

机构地区:[1]江西理工大学信息工程学院,江西赣州341000 [2]华南农业大学信息学院,广州510642

出  处:《计算机应用研究》2012年第8期2895-2898,2908,共5页Application Research of Computers

基  金:国家自然科学基金资助项目(70971043);江西省自然科学基金资助项目(2008GZS0028)

摘  要:结合ID3算法的不足,提出一种基于属性重要度简化标准的ID3改进算法:a)简化ID3算法的信息熵从而降低算法的计算时间;b)引入属性重要度概念来弥补ID3算法属性选择标准的不足;c)综合a)和b)来实现新的属性选择标准即属性重要度简化标准。在开源的Weka数据挖掘软件环境下进行仿真实验,结果表明该改进算法是可行的,并且在算法的计算时间和准确度方面都优于ID3算法,尤其是在数据样本集规模达到一定数量时,效果更加明显。Combining the defects of the ID3 algorithms, this paper proposed an improved ID3 algorithm based on importance of attributes simplified criterion. This algorithom a) simplified the information entropy of ID3 algorithm to reduce the computational time, b)introduced the importance of attribute concept to remedy the inadequacy of the attribute selection criterion of ID3 algorithm,c) combined in a) and b) to achieve a new attribute selection criterion which was the important degree of attributes reduction criterion. Simulation experiments were carried out in the open source Weka data mining software. The results show that the improved algorithm is feasible, and the computation time and accuracy are better than the ID3 algorithm, especially in the sample data set to achieve a certain amount, effect is more obvious.

关 键 词:简化 ID3算法 重要度 数据挖掘软件 

分 类 号:TP301.6[自动化与计算机技术—计算机系统结构]

 

参考文献:

正在载入数据...

 

二级参考文献:

正在载入数据...

 

耦合文献:

正在载入数据...

 

引证文献:

正在载入数据...

 

二级引证文献:

正在载入数据...

 

同被引文献:

正在载入数据...

 

相关期刊文献:

正在载入数据...

相关的主题
相关的作者对象
相关的机构对象