汉语分词对中文搜索引擎检索性能的影响  被引量:6

Influence of Chinese Word Segmentation on Web Information Retrieval

在线阅读下载全文

作  者:金澎[1] 刘毅[1] 王树梅[2] 

机构地区:[1]乐山师范学院计算机科学系,四川乐山614004 [2]南京理工大学计算机科学与技术系,南京210014

出  处:《情报学报》2006年第1期21-24,共4页Journal of the China Society for Scientific and Technical Information

基  金:四川省教育厅青年基金资助项目(项目编号:2003B035).

摘  要:针对中文网页的特点。研究了汉语分词对中文搜索引擎检索性能的影响。首先介绍中文分词在搜索引擎中的作用,然后介绍常用的分词算法。作者利用啊页特征,提出一个简单的“带启发性规则的双向匹配分词策略”。最后,在10G的语料库中,就各种分词算法对查全率和查准率的影响进行了实验比较,结果表明分词性能和检索性能没有正比关系。In this paper, we focus on the influence of Chinese word segmentation on Web information retrieval. We conduct some experiments by indexing the Chinese Web pages to search the relevant pages. Both Chinese words and character are index unit. The results of experiments present that there is a non-monotonic relationship between Chinese word segmentation and retrieval performance.

关 键 词:汉语分词 信息检索 中文搜索引擎 

分 类 号:G354.4[文化科学—情报学] TP393[自动化与计算机技术—计算机应用技术]

 

参考文献:

正在载入数据...

 

二级参考文献:

正在载入数据...

 

耦合文献:

正在载入数据...

 

引证文献:

正在载入数据...

 

二级引证文献:

正在载入数据...

 

同被引文献:

正在载入数据...

 

相关期刊文献:

正在载入数据...

相关的主题
相关的作者对象
相关的机构对象