FP增长算法实验报告wx_第1页
FP增长算法实验报告wx_第2页
FP增长算法实验报告wx_第3页
FP增长算法实验报告wx_第4页
FP增长算法实验报告wx_第5页
已阅读5页,还剩9页未读, 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

1、FP增长算法实验报告实验人:王虓学号:20101174实验目的了解关联规则在数据挖掘中的应用,理解和掌握关联挖掘的经典算法增长算法的基本原理和执行过程并完成程序设计。实验内容对给定数据集用增长算法进行挖掘,找出其中的频繁集并生成关联规则。对下面数据集进行挖掘:实验步骤首先数据库第一次扫描,导出频繁项集(1项集)的集合和支持度计数。频繁项的集合按支持度计数的递减序排序,记为,同时对事物数据库的每条记录也进行排序。构造树,建的根节点记为并且标记为。然后对数据库中的每个事务把中排好序的事务项列表进行建树,为方便树的遍历创建一个项头表。树挖掘处理:由长度为的频繁模式(初始后缀模式)开始,构造它的条件模

2、式基。然后,构造它的(条件)树,并递归地在该树上进行挖掘。模式增长通过后缀模式与由条件树产生的频繁模式连接实现。实验过程主要代码:获取频繁模式最小/支持/度/计数最小/支持/度事务/数/据/库中的所有事务总数测试/集的/文件名测试数据集路径分析数/据挖掘读取数据集/,并/遍历取得频繁一项集程序分析总时间支持度阀值设置计数支持度计数频繁个项集支持度支持度按顺/序/显/示字符频繁一项集计数小的计数往下排统提示系统方法请先预处理数据以计算事务总数系预处理计算事务总项数读取当前行设置/数/据所/在位置设计/支持/度/读取数据集并遍历取得频繁一项集设置支持度计数设置测试数据/集/开始位置来保存一项集读取当前行提取当前行的数组将数组放到内存中将频繁项集合放到中频繁对传参设置支持度传参实验结果ItemSetCountIS2P曾长方法将发现长频繁模式的问题转换成递归地发现一些短模式,然后与后缀连接。它使用最不频繁的项作后缀,降低了搜索开销。当数据库很大时,构造基于内存的树是不现实的。对于

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

最新文档

评论

0/150

提交评论