检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
出 处:《软件导刊》2011年第7期28-29,共2页Software Guide
摘 要:"相似重复记录检测"是数据清洗要解决的主要问题之一,对于提高数据质量及决策可靠性起到关键作用。编写SQL存储过程脚本实现了一种相似重复记录检测算法———PCM算法,测试了算法性能,针对PCM算法时间复杂度较高的缺陷,提出了利用SQL语句优化技术改进算法执行效率。"Approximately Duplicated Records Examining" is an important problem one of data cleaning algorithms,it is helpful to improve data quality and reliability of decision.The paper composed sql stored procedure scripts to realize a kind of approximately duplicated records examining algorithm-PCM algorithm,and tested the performance of it.Thinking over the drawback of the higher time complexity of PCM algorithm,and then put forward the SQL tuning technologies to improve the executing efficiency.
分 类 号:TP306.2[自动化与计算机技术—计算机系统结构]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:216.73.216.179