检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
出 处:《情报理论与实践》2007年第2期252-255,共4页Information Studies:Theory & Application
摘 要:互联网网页是通过超链接连接起来的,为人们的日常生活和商务用途提供了非常丰富的信息资源。链接结构分析在万维网的很多研究领域发挥着越来越重要的作用。然而存在着许多与主题无关的链接,造成了主题漂移。本文分析了链接本身的特点,介绍了一种有监督机器学习方法自动地抽取网页中的相关链接。试验结果表明该算法具有实用的价值。The hyperlinked Web pages on the Internet provide very rich information resources for daily life and commercial use. The Web linkage analysis is playing a more and more important role in the researches on the World Wide Web. However, there are a lot of linkages irrelative to topics, which lead to topic drift. In this paper, a new method of Web linkage extraction is proposed by analyzing the features of the linkage anchors as supervised machine learning task. The experiment shows that this algorithm is of practical value.
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:216.73.216.171