一种改进的基于《知网》的词语相似度计算方法  被引量:26

Modified word similarity computation approach based on HowNet

在线阅读下载全文

作  者:林丽[1] 薛方[1] 任仲晟[2] 

机构地区:[1]集美大学计算机工程学院,福建厦门361021 [2]福建师范大学计算机实验中心,福州350007

出  处:《计算机应用》2009年第1期217-220,共4页journal of Computer Applications

摘  要:《知网》是一部比较详尽的中文语义知识词典,共用1618个义原描述词语,故相关的词语用《知网》的概念描述时,有相同的义原。通过这一规律,与当前的词语相似度计算方法结合,提出改进的方法计算相关词对的相似度。并引入弱义原的概念,排除弱义原对词语相似度计算的干扰。实验证明:该改进方法更符合人的直观,更适用于文本挖掘。HowNet is a lexical base with rich semantic information. It uses 1618 sememes to describe words. The related words have the same sememe when they are described by the HowNet. Combined with the current computation algorithm of the words' similarity, the paper proposed an improved algorithm to compute the similarity between the related words. It also introduced concept about weak sememes and excluded such sememes' interference when they appeared in the computation of the word's similarity. The experiment proves the improved word similarity computation meets the peoples' intuition and text mining better.

关 键 词:《知网》 词语相似度 相关词对 弱义原 

分 类 号:TP18[自动化与计算机技术—控制理论与控制工程] TP311.53[自动化与计算机技术—控制科学与工程]

 

参考文献:

正在载入数据...

 

二级参考文献:

正在载入数据...

 

耦合文献:

正在载入数据...

 

引证文献:

正在载入数据...

 

二级引证文献:

正在载入数据...

 

同被引文献:

正在载入数据...

 

相关期刊文献:

正在载入数据...

相关的主题
相关的作者对象
相关的机构对象