检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
作 者:杨代庆[1,2,3] 王志苹[1] 王星[1] 刘敏健[1] 常迎春[1]
机构地区:[1]中国科学技术信息研究所,北京100038 [2]中国科学院国家科学图书馆,北京100190 [3]中国科学院研究生院,北京100049
出 处:《现代图书情报技术》2011年第2期29-33,共5页New Technology of Library and Information Service
基 金:国家十一五科技支撑计划子课题"网络科技信息监测与评价"(项目编号:2006BAH03B05)的研究成果之一
摘 要:针对新闻组的海量性及相关编码特点设计新闻帖抓取流程,采用多线程方式加快新闻帖的抓取及解析速度,同时设计一种便于海量数据断点续传的数据存储结构,通过实验采集验证该方法能有效达到信息检测的数据采集要求,抓取及解析新闻帖的速度比普通单线程抓取解析方式有显著提高。A usenet - snatcher is designed based on multithread to improve the download - speed and MIME - parsing - speed and a storage schema supporting breakpoint transmission is also proposed. Experiment shows that the usenet - snatcher can gather articles effectively and gathering - speed under muhithread is faster than single thread.
分 类 号:TP393.09[自动化与计算机技术—计算机应用技术]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:216.73.216.173