基于扩展标记图的Web信息抽取器  被引量:2

Web Information Extractor Based on Extended Tag Graph

在线阅读下载全文

作  者:王亮[1] 朱征宇[1] 

机构地区:[1]重庆大学计算机学院,重庆400044

出  处:《计算机工程》2005年第8期159-161,191,共4页Computer Engineering

基  金:重庆大学骨干教师资助计划项目(2003A33)

摘  要:介绍了一种新的Web信息抽取器,该抽取器基于扩展标记图模型,实现了数据和模式的分离,应用于Web检索系统中,能够有效地支持标记级实时信息检索、抽取和重组。还介绍了其在Web信息检索系统PowerSearcher中的实际应用。A new Web information extractor is discussed. It is based on extend tag graph (ETC), and has the ability to separate the data from the pattern data. This extractor is used in Web information retrieval, with supporting effective real-time information retrieval, extract and reform in tag level inside the Web page. Besides the design of the extractor, it also discusses its practice in experimental system.

关 键 词:Web信息抽取器 扩展标记图 半结构数据 WEB检索 

分 类 号:TP391[自动化与计算机技术—计算机应用技术]

 

参考文献:

正在载入数据...

 

二级参考文献:

正在载入数据...

 

耦合文献:

正在载入数据...

 

引证文献:

正在载入数据...

 

二级引证文献:

正在载入数据...

 

同被引文献:

正在载入数据...

 

相关期刊文献:

正在载入数据...

相关的主题
相关的作者对象
相关的机构对象