检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
机构地区:[1]西安培华学院,西安710125
出 处:《电脑编程技巧与维护》2017年第5期48-50,共3页Computer Programming Skills & Maintenance
基 金:陕西省高等教育教学改革研究项目(15BY122);西安培华学院校级课题+PHKT16045+智慧西安医疗云服务平台的数据仓库解决方案
摘 要:针对传统分布式模型在海量日志并行处理时的可扩展性和并行程序编写困难的问题,提出了基于数据仓库的海量搜索日志分析系统架构。利用Hadoop分布式文件系统(HDFS)存储海量搜索日志,并对搜索日志进行清洗处理,采用impala对数据进行高速的处理,将处理后的统计结果导入到数据仓库中,使用Pentaho BI对数据进行多维分析和统计报表。获取了关键词分析、查询频率、热词排行、查询词和时间分布、网站排名、用户统计等6个分析主题。分析结果对于搜索引擎的排序算法和系统优化都有一定的指导意义。
分 类 号:TP311.13[自动化与计算机技术—计算机软件与理论]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:18.217.0.242