2.5.3 典型Web数据挖掘技术

更新于 2026年10月10日 版权声明
2.5.3 典型Web数据挖掘技术

Web数据挖掘有众多应用,根据不同应用场景可以使用不同的Web数据挖掘技术进行信息挖掘。

1)分类技术

分类技术可以根据捕获的Web访问用户的个人信息或者共同的访问模式,分析出访问某一服务器文件的用户特征。Web数据挖掘中常用的分类技术有:贝叶斯分类和贝叶斯网络、判定树归纳、神经网络、遗传算法、基于案例的推理、粗糙集方法和模糊集方法等。

2)关联规则挖掘技术

关联规则挖掘就是要挖掘出用户在一个访问会话期间从服务器上访问的页面或者文件之间的联系,这些页面之间可能并不存在直接的引用关系。最常用的算法是Apriori算法,它从事务数据库中挖掘出最频繁访问项集,这个集就是关联规则挖掘出来的用户访问模式。(https://www.daowen.com)

3)时间序列模式技术

时间序列模式挖掘就是要挖掘出交易集之间有时间序列的模式。在网站服务器日志里,用户的访问是以时间段为单位记载的,经过确认数据净化和事件交易得到一个间断的时间序列所反映的用户行为,有助于帮助商家印证其产品所处的生命周期阶段。

4)路径分析技术

用路径分析技术进行Web数据挖掘时,最常用的是图。因为Web可以用一个有向图来表示,G=(V,E),V是页面集合,E是页面之间的超链接集合。页面抽象为图中的顶点,而页面之间的超链接抽象为图中的有向边,顶点V的入边表示对V的引用,出边表示V引用了其他页面。

↑上一章 ↓下一章
关注公众号获取验证码
复制内容需要验证码(7.99元/天)