检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
出 处:《计算机应用与软件》2014年第6期162-164,212,共4页Computer Applications and Software
基 金:河南省科技攻关计划项目(102102210509);云南省科技计划项目(2011FZ074)
摘 要:针对短文本的特点,提出一种自动识别短文本特征词的方法。根据短文本中的名词或动词之间语义相似度构造图的邻接矩阵,在图的邻接矩阵基础上提出一种候选特征词的特征度计算方法,选择特征度较大的一些词作为特征词。实验结果表明,所提出的特征提取方法较传统的特征提取方法更适合短文本的分类。In view of the characteristics of short text, the paper proposes a method to automatically recognize short text feature words. According to adjacent matrix of semantic similarity structural graph between nouns or verbs from short text, on the basis of graph' s adjacent matrix, the paper proposes a feature degree calculation method for candidate feature words, which selects words of greater feature degrees as feature words. Experiment results show that the proposed feature extraction method is more suitable for short text classification compared to traditional feature extraction methods.
分 类 号:TP391.1[自动化与计算机技术—计算机应用技术]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:216.73.216.222