检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
机构地区:[1]山西大学计算机科学系,太原030006 [2]山西大学数学系,太原030006
出 处:《计算机工程与应用》2004年第13期64-65,191,共3页Computer Engineering and Applications
基 金:山西省青年科技研究基金项目(编号:20031027)
摘 要:提出了一种基于字特征的中文文本分类方法。该方法的出发点是变常用的基于表层的匹配为基于概念的匹配,用汉字特征向量作为文本的表示方法。算法根据文本中汉字的特征建立文本表示矩阵和类别表示矩阵,并通过线性最小二乘算法形成分类矩阵。This paper introduces a method on automatic text categorization based on the statistic features of Chinese characters.The significant character of this method is to make a shift from the surface-based matching to conception-based matching.It takes Chinese features vector as text expression ways.Algorithm should build text expressing matrix and classification expressing matrix according to Chinese character features in text,and build classification matrix through using LLS(Linear Least Square)technique.
分 类 号:TP391.12[自动化与计算机技术—计算机应用技术]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:216.73.216.222