检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
机构地区:[1]清华大学计算机科学与技术系,北京100084
出 处:《计算机应用研究》2008年第5期1333-1336,共4页Application Research of Computers
基 金:国家自然科学基金资助项目(90604025)
摘 要:重点研究事件检测模型中层次聚类算法的改进,提出利用在关键词抽取基础上利用新闻的各种要素信息计算新闻之间相似度的方式,搭建了一个在线新闻检索系统,在其上利用新华社的新闻语料进行实验。实验结果表明改进方法的效果明显,性能较之未使用前有显著的提升。This paper proposed an algorithm utilizing several methods to address the problem. It used keyword extraction to reduce the vector space model of the news and selected the keyword that could represent the news story mostly. It proposed a hierarchical clustering algorithm utilizing news metadata for similarity computing in a unified framework. Furthermore, based on this approach, it built an on-line news search system, which provided functions to organize news data into news event, and furthermore provided personalized Service for users. Experimental results on news data from Xinhua News agency show that both the proposed approaches can effectively improve the performance of RED task, compare to the baseline method.
分 类 号:TP301[自动化与计算机技术—计算机系统结构]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:216.73.216.249