检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
机构地区:[1]合肥工业大学管理学院,合肥230009 [2]合肥工业大学过程优化与智能决策教育部重点实验室,合肥230009
出 处:《计算机工程与应用》2015年第11期109-113,共5页Computer Engineering and Applications
基 金:国家"863"云制造主题项目(No.2011AA040501);国家自然科学基金(No.71271071)
摘 要:在文本分类系统中,特征的优劣往往极大地影响着分类器的设计和性能。提出一种利用分形维数和带精英策略的非劣支配排序遗传算法进行特征选择的方法。在该方法中分形维数作为特征选择的一个评价机制,利用NSGA-II算法将特征子集选择问题视为多目标优化问题来处理。为了分析结果的有效性,利用SVM分类算法对复旦大学语料库进行测试。实验结果表明该方法具有较好的性能,它可以有效去除无效特征并提高分类准确性。In text categorization system, the characteristics of the advantages and disadvantages often greatly affect the design of classifier and performance. A feature subset selection algorithm is presented based on fractal dimension and with elitist strategy of fast non-dominated sorting genetic algorithm. In the algorithm, fractal dimension is used as an evaluation mechanism and NSGA-II algorithm will regard feature subset selection problem as a multi-objective optimization problem to deal with. In order to analyze the validity of the results, the SVM algorithm is utilized to test Fudan University Corpus. The experimental results show that this method has good performance, it can effectively remove the invalid character and improve classification accuracy.
分 类 号:TP301[自动化与计算机技术—计算机系统结构]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:216.73.216.11