检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
出 处:《微电子学与计算机》2016年第3期120-124,共5页Microelectronics & Computer
基 金:国家自然科学基金项目(U1301253)
摘 要:针对目前数据量增长迅速,数据特征多,存储空间不足等问题,提出了基于AutoEncoder的增量式聚类算法(ANIC).首先利用AutoEncoder学习数据样本的特征,进行低维特征整合,得到数据样本的压缩表示形式,然后在原有聚类结果的基础上,通过一遍式读取数据和动态更新聚类中心点,对新生成样本进行增量式聚类.在对UCI的四个数据集进行聚类时,实验结果表明该算法能够得到优于k均值算法(Kmeans)和模糊c均值算法(FCM)的聚类效果.同时,该算法的时间消耗低,能够识别离群点,能够有效地对不断增加的数据集进行增量式聚类.The rapid growth of data result in a lot of problems such as the data have too many features, me Lack of storage space etc. This paper propose a new incremental clustering algorithm based on AutoEncoder . Firstly , the AutoEncoder are used to learn the features of the data , integrate the low-dimensional feature , and get the reduced representation from the raw data. Then run incremental clustering on the new data base on the original clustering results by reading the data once and dynamically update clustering centers . Experimental results show that the proposed algorithm can obtain a comparable clustering performance with k-means algorithm (Kmeans) and fuzzy means algorithm (FCM) on the four data set in UCI database. Meanwhile, the time consumption of the proposed algorithm is low, it can achieve incremental clustering and identify the outliers for the increasing data set effectively.
关 键 词:AutoEncoder 增量聚类 特征学习 数据压缩
分 类 号:TP301.6[自动化与计算机技术—计算机系统结构]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:3.139.94.189