检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
机构地区:[1]苏州大学智能信息处理研究所,江苏苏州215006
出 处:《计算机应用研究》2009年第5期1754-1756,1759,共4页Application Research of Computers
基 金:国家自然科学基金资助项目(60673092);2005年度国家教育部科研重点项目(205059);2006年江苏省"六大人才高峰"项目(06-E-037);2006年度江苏省软件和集成电路业专项经费资助项目([2006]221-41)
摘 要:为了估计网络数据库的大小,提出了基于Capture-Recapture过滤二字亲密、二字排斥的方法。通过在接口文本框提交属性高频字,利用返回的结果集,在两两之间作交集,根据交集中的两字分布分析采样的独立性,过滤掉其中不独立的情况,再利用Capture-Recapture方法估计网络数据库的大小。在模拟和真实的环境下进行了实验,该方法偏差度和波动度均较小。In order to estimate the size of Web database, this paper proposed the Capture-Recapture based estimation methods that filtered out two words intimate and rejection cases. Submitting attributed high-frequency words in the text box of query interface, using the returned result, in the intersection of two results analyzing the independence of two sampling, filtering the dependent couples, and then using Capture-Recapture method estimated the size of Web database. In the simulated and real environment for the experiment, the bias and the volatility of the method are smaller.
分 类 号:TP311[自动化与计算机技术—计算机软件与理论]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:216.73.216.62