检索规则说明:AND代表“并且”;OR代表“或者”;NOT代表“不包含”;(注意必须大写,运算符两边需空一格)
检 索 范 例 :范例一: (K=图书馆学 OR K=情报学) AND A=范并思 范例二:J=计算机应用与软件 AND (U=C++ OR U=Basic) NOT M=Visual
机构地区:[1]燕山大学信息科学与工程学院,河北秦皇岛066004
出 处:《燕山大学学报》2008年第1期10-13,共4页Journal of Yanshan University
摘 要:提出一种利用网页特征进行会话识别的方法。通过分析网页本身的特征,计算站点中所有网页的特征向量。根据这些特征向量,可以计算任意网页之间的相关程度。按照用户请求页面在日志中的时间顺序,可以得到日志中所有直接相邻的页面记录的关联程度曲线。通过设定一个阈值,在关联程度曲线中波动较大的位置形成会话边界。将关联程度大的页面分类到一个会话中,从而完成会话识别。In this paper, a method of sessions' identification based on the feature of web pages is proposed. After the features of web pages are analysed, the feature vectors of all web pages in a website are computed. Based on the feature vectors, the relativity between any two web pages could be computed. According to the time sequence of user's request pages in the web log, a curve of relativity between any two direct neighbor web pages could be found. After a threshold is set up, sessions' border would be found at the position where the fluctuation are great in the curve of relativity. After the high relative web pages are put into one sesstion, sessions' identification is completed.
分 类 号:TP311[自动化与计算机技术—计算机软件与理论]
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在载入数据...
正在链接到云南高校图书馆文献保障联盟下载...
云南高校图书馆联盟文献共享服务平台 版权所有©
您的IP:216.73.216.15