检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
作 者:肖雪[1]
出 处:《计算机与网络》2015年第9期36-38,共3页Computer & Network
摘 要:针对文本信息海量增加的现状,快速、准确、全面地获取有用信息的大规模信息处理应用技术越来越受到关注。本文将中文文本分类的类别体系构建为层次结构,并把最大熵模型引入中文文本的层次分类,该模型用于得到未知事件分布的最大熵。实验证明,最大熵模型方法的层次分类性能在很多时候优于平面分类,是一种有效的中文文本分类方法。In view of the present situation of mass text information, the technology of large-scale information processing and application, with which people can obtain useful information quickly, accurately, and comprehensively, draws more and more attention. This paper organizes categories into hierarchical structure according to the certain relations. And the maximum entropy model is introduced to hierarchical text classification and used to obtain the maximum entropy of unknown event distribution. The experimont~ results show that the hierarchical classification performance of maximum entropy model outperforms that of plane methods, and it is an effective technique for text classification.
分 类 号:TP391.1[自动化与计算机技术—计算机应用技术]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:216.73.216.117