基于JavaScript切片的AJAX框架网络爬虫技术研究  被引量:10

Web Crawler Technology of AJAX Frame Based on JavaScript Slicing

在线阅读下载全文

作  者:曾伟辉[1,2] 李淼[1] 

机构地区:[1]中国科学院合肥智能机械研究所,安微合肥230031 [2]中国科学技术大学 信息科学技术学院自动化系,安微合肥230027

出  处:《计算机系统应用》2009年第7期169-171,137,共4页Computer Systems & Applications

基  金:中国科学院知识创新工程重要方向项目(KGCX2-SW-511)

摘  要:自Jesse James Garrett提出了AJAX概念以来,由于AJAX在提升用户交互体验的同时,又不需要在客户端安装插件。因此,一经提出就引起了互联网领域的广泛关注。但目前的网络爬虫技术在AJAX框架的URL解析过程中存在着不能够识别事件触发顺序等问题,导致大量数据不能被搜索引擎有效检索。本文针对此问题,通过研究基于对象的程序切片算法,以及脚本执行引擎与切片模块的互操作,最终解决AJAX框架中URL提取以及异步JavaScript网络爬虫系统的关键技术问题。

关 键 词:JAVASCRIPT 程序切片 网络爬虫 有限状态机 AJAX 

分 类 号:TP311.10[自动化与计算机技术—计算机软件与理论]

 

参考文献:

正在载入数据...

 

二级参考文献:

正在载入数据...

 

耦合文献:

正在载入数据...

 

引证文献:

正在载入数据...

 

二级引证文献:

正在载入数据...

 

同被引文献:

正在载入数据...

 

相关期刊文献:

正在载入数据...

相关的主题
相关的作者对象
相关的机构对象