检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
机构地区:[1]炮兵学院一系 [2]南京理工大学计算机系,南京210094
出 处:《计算机工程》2004年第18期124-126,共3页Computer Engineering
摘 要:以路透社财经新闻语料库为实验数据集,比较了主流文本表示方式BOW和独立于语言的字符串表示方式n-Gram,在k近邻和支持向量机分类器下的分类效果,得出了上述两种不同文本表示方式的分类结果之间不存在显著差异的结论。To compare the impact of two different text representation methods on the performance of support vector machines and k-nearest neighbor classifiers extensive experimental, studies are conducted on Reuters-21578 datasets. Statistical analysis of these experimental results shows that there is no significant difference between the two text representation methods.
关 键 词:文本分类 文本表示 支持向量机 K近邻 秩和检验
分 类 号:TP181[自动化与计算机技术—控制理论与控制工程]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:18.119.131.79