检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
出 处:《计算机科学》2014年第9期239-242,共4页Computer Science
基 金:国家自然科学基金(71272144);广州市科技计划项目(2013KP084);广东省自然科学基金项目(8151063101000040)资助
摘 要:在大数据环境下,当利用机器学习算法对训练样本进行分类时,训练数据的高维度严重制约了分类算法的性能。文中应用L1准则的稀疏性,提出了一种在线特征提取算法,并用该算法对训练实例进行分类。利用公开数据集对算法的性能进行了分析,结果表明,提出的在线特征提取算法能准确地对训练实例进行分类,因而能更好地适用于大数据环境下的数据挖掘。In big data, the high dimension of training samples makes it difficult for classifying these samples during data mining. Applying the sparsity of the L1 norm, this paper proposed an online feature selection algorithm, and used this algorithm to classify the training samples. Experiments on public datasets show that the proposed online feature selection algorithm has better prediction accuracy than related work, and thus can be applicable to data mining for big data.
分 类 号:TP312[自动化与计算机技术—计算机软件与理论]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:216.73.216.117