检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
机构地区:[1]重庆邮电大学计算机科学与技术研究所,重庆400065
出 处:《广西师范大学学报(自然科学版)》2011年第4期35-38,共4页Journal of Guangxi Normal University:Natural Science Edition
基 金:国家自然科学基金资助项目(60703010);重庆市自然科学基金资助项目(2009BB2079)
摘 要:已知朴素贝叶斯分类器使用两步策略的分类方法提高了两类中文文本分类的效率,本文在此基础上,研究3个问题:1可以使用两步策略分类方法的分类器须满足的条件;23种理论上可用两步策略进行文本分类的分类器;3实验比较Rocchio、朴素贝叶斯、KNN 3种分类器两两组合后应用于多类英语文本分类的效果。实验结果表明:Rocchio、朴素贝叶斯、KNN 3种分类器满足两步策略分类的条件,且当KNN作第一步分类器,朴素贝叶斯作第二步分类器时分类效果最好。Naive Bayesian classifier is known to use two-step classification strategy to improve the efficiency of two types of Chinese text categorization. This paper tries to solve the following three questions:(1) the condition of a classifier to be fulfilled by using two-step strategy text classification, (2) the theoretical analysis of the three classifiers which can be used for two-step strategy text classification, (3) experimental results comparison of Rocchio,Naive Bayes,KNN combination used in many types of English text classification. Experimental results show that the Rocchio,NB and KNN satisfy the condi- tions of two-step strategy. Best performance is achieved by using KNN as the first step classifier and NB as the second.
关 键 词:文本分类 两步策略 ROCCHIO 朴素贝叶斯 K近邻
分 类 号:TP18[自动化与计算机技术—控制理论与控制工程]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:3.148.200.110