检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
作 者:杨文[1] 李文敬[1] 李双[1] 李书举 林中明[1]
机构地区:[1]广西师范学院计算机与信息工程学院,广西南宁530023 [2]河南省长垣县人民防空办,河南长垣453400
出 处:《广西师范大学学报(自然科学版)》2013年第3期87-93,共7页Journal of Guangxi Normal University:Natural Science Edition
基 金:国家自然科学基金资助项目(61163012);广西自然科学基金资助项目(2012GXNSFAA053218);广西高校科学技术研究资助项目(2013YB147);广西研究生教育创新计划资助项目(YCSZ2012099)
摘 要:针对数据挖掘中流数据分类精度不高,数据压缩率低的问题,提出一种基于粒度分析与转存式GEP的流数据分类压缩并行算法,实现流数据的快速并行分类压缩。首先使用粒度分析技术对流数据的属性求得极小粒度集,根据划分规则得到近似粒度空间,然后根据不同类型流数据建立不同的G EP分类器模型,最后采用动态转存记录集形式,将数据送至GEP压缩模型实施压缩。再将串行算法扩展到M PI+OpenM P混合编程模型后得到其并行算法,采用UCI数据、通讯账单验证算法的性能。实验结果表明,分类压缩效果耗时较理想,压缩比效果明显,其中在校学生通讯账单耗时在96 s左右,压缩比达到1/3。Considering the low accuracy of the stream-data classification hasn't high accuracy and com-pression rate for data mining,the stream-data parallel classification compression algorithm was proposed based on granular analysis and storage of GEP in order to achieve faster parallel classification compres-sion algorithm of streaming data. Firstly, get the least set of stream-data with the granular analysis method ,and the approximate granular space according to division rules. Secondly, establish correspond- ing GEP classification model for different stream-data^Finally,send the data to compression model of GEP and compression data with dynamic storage record set form^extend serial algorithm to the parallel algorithm in MPI+OpenMP hybrid programming model,and verify the algorithm performance with the UCI data and communications bill. The experimental result shows that the effect of the classification compressions time-consuming and the compression ratio are satisfactory, the student's communication bill time-consuming is about 96 s,and the compression ratio can be achieved to 1/3.
分 类 号:TP393[自动化与计算机技术—计算机应用技术]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:216.73.216.229