一种基于同义词消除的文本过滤方法  

A Text Filtering Method Based on Synonym Elimination

在线阅读下载全文

作  者:杭娟[1] 张冬茉[1] 

机构地区:[1]上海交通大学计算机科学与工程系,上海200030

出  处:《计算机工程与应用》2006年第19期180-182,共3页Computer Engineering and Applications

摘  要:传统的向量空间过滤模型通常是提取字、词、短语等作为特征项,这样做的缺点是没有考虑文本的语义信息。文章提出了利用知网对向量空间模型的文本向量进行同义词消除的过滤方法。该方法比传统的单纯基于关键词匹配的方法更精确地体现了文本之间的相似度,提高了过滤性能,同时也降低了向量空间的维数,减少了计算量,提高了过滤的效率,实验结果表明基于该文的过滤方法确实提高了系统的性能。The traditional VSM(Vector Space Model) system often selects words as the feature,and one of its shortness is the lack of Semantic information in document representation.In this paper,we present a kind of filtering method which selects all of the synonyms of each feature in the document vector and replace them as one of them based on HowNet. This method approves the system's effilciency and precision,and the result of the experiment also proves its availability.

关 键 词:文本过滤 向量空间 用户模板知网 同义词消除 

分 类 号:TP391[自动化与计算机技术—计算机应用技术]

 

参考文献:

正在载入数据...

 

二级参考文献:

正在载入数据...

 

耦合文献:

正在载入数据...

 

引证文献:

正在载入数据...

 

二级引证文献:

正在载入数据...

 

同被引文献:

正在载入数据...

 

相关期刊文献:

正在载入数据...

相关的主题
相关的作者对象
相关的机构对象