首页 | 本学科首页   官方微博 | 高级检索  
相似文献
 共查询到19条相似文献,搜索用时 62 毫秒
1.
有效地进行频繁项挖掘一直以来都是数据挖掘任务中最为重要的组成部分。已有的大部分频繁项挖掘算法在数据项多及支持度低的情况下,算法的效率急剧下降。为了有效地解决此类问题,提出了一种采用双向十字链表结构的频繁项挖掘算法(two-way crossed list for frequent itemsets mining,TCLFI)。极大地降低了搜索空间,加快了频繁项的筛选过程,减少了所需保存的数据项个数,从而降低了时间复杂度,提高了频繁项的挖掘效率。实验通过真实数据集和合成数据集验证了算法的有效性和扩展性。  相似文献   

2.
一种基于十字链表的频繁项集挖掘算法   总被引:1,自引:0,他引:1  
在Apriori算法的基础上,提出一种基于十字链表的关联规则挖掘算法。该算法能够快速得到每个候选项的支持度,从而有效的发现频繁项集。通过与经典算法分析对比表明,该算法具有明显的优势。  相似文献   

3.
基于改进FP-树挖掘最大频繁模式   总被引:3,自引:1,他引:3  
由于挖掘密集型数据的频繁模式完全集非常困难 ,因而改进了传统的FP -树结构并提出了一种基于改进FP -树的最大频繁模式挖掘算法IFP -MAX ;通过引入后缀子树的概念 ,在挖掘过程中不用生成最大频繁模式候选集 ,大大提高了算法的时空效率。实验表明 ,IFP -MAX的挖掘速度比Miafia和GenMax快得多  相似文献   

4.
传统的基于支持度—置信度框架的关联规则挖掘方法可能会产生大量不相关的、甚至是误导的关联规则,同时也不能区分正负关联规则。在充分考虑用户感兴趣模式的基础上,采用一阶谓词逻辑作为用户感兴趣的背景知识表示技术,提出了一种基于背景知识的包含正负项目集的频繁模式树,给出了针对正负项目集的约束频繁模式树的构造算法NCFP-Construct,从而提高了关联规则挖掘的效率和针对性,实验结果显示该方法是有效的。  相似文献   

5.
探索有约束限制的频繁模式的挖掘问题,目的是要建立一个基本框架,通过构造一种新的数据结构--约束树,解决了确定一个项集的最小约束值的关键问题.在此基础上进一步提出了一种有约束限制的模式增长算法,并进行了初步的实验验证.实验结果表明,新的算法比以前类似算法在性能上有显著提高.  相似文献   

6.
在挖掘最大频繁项目集的过程中,通过改变最小支持度阈值可以挖掘更有用的最大频繁项目集,为此提出了一种最大频繁项目集更新挖掘算法UAMMFI(Updating Algorithm for Mining Maximal Frequent Itemsets)。算法基于改进后的频繁模式树结构,在更新挖掘过程中,不需产生候选项目集和条件模式树,并且充分利用先前已挖掘的最大频繁项目集中包含的信息,快速更新挖掘出最小支持度阈值变化后的最大频繁项目集。实验结果表明,算法能够高效更新挖掘最大频繁项目集。  相似文献   

7.
针对垂直数据分布数据库FP-tree生长基本算法中存在的链接点表空间随问题规模线性增加的问题提出一种改进算法.采用定长的链接点表进行分段扫描,在空间需求恒定的前提下构造FP-tree.证明了改进算法与基本算法构造的FP-tree是同构的.实验与分析结果表明,当应用于同一数据集时,改进算法所需空间恒定.  相似文献   

8.
基于频繁模式树的关联分类规则挖掘算法   总被引:1,自引:1,他引:1  
构建精确而有效的分类器是数据挖掘和机器学习中的一个重要任务.提出了一种基于频繁模式树的关联分类规则挖掘算法,该算法同时考虑所有属性,并对现有关联分类规则挖掘算法中内存要求高、类别属性处理难、I/O访问次数多等问题提出了相应的解决方案.试验结果表明,该方法可以取得比同样基于关联规则的分类算法CMAR更高的执行效率以及基于规则的决策树分类算法C4.5更好的分类效果.  相似文献   

9.
目的解决在关联规则挖掘中存在大量无用的候选项集和频繁项集以及效率不高的问题。方法提出了一种基于十字链表的关联规则改进算法。结果利用用户给定的条件和剪枝算法减少了候选项集的数量,再遍历十字链表确定频繁项集,结果表明算法提高了挖掘效率。结论基于十字链表的关联规则改进算法避免了重复扫描数据库,提高了挖掘效率。  相似文献   

10.
分析了基于频繁模式的关联规则算法Fptree,给出了一种基于二进制表示的改进算法,详细介绍了该算法的主要思想,算法实现方案.并通过实例比较了两种算法,证明新算法提高了挖掘规则的效率.  相似文献   

11.
设计并实现了一种基于红黑树的列表结构. 列表中数据存储在红黑树节点中,红黑树的高效查找性能使列表的查找时间复杂度为O(logn). 实验表明,其查找效率比遍历查找快2个数量级以上,与二分查找相当. 该列表结构适合于各种频繁添加、删除、查找的应用.  相似文献   

12.
在图的一种双链式存储结构的基础上提出了一种扩展的双链式存储结构.并用这种存储结构实现了图的最小生成树算法,与其它存储结构相比具有更好的灵活性.  相似文献   

13.
论数据结构中二叉树的链式存储   总被引:1,自引:0,他引:1  
二叉树是树型结构中的重点研究对象。二叉树的操作是以二叉树的存储为基础,其存储主要包括顺序存储和链式存储,常用的是链式存储。目前研究者对二叉树的链式存储缺少一个全面、系统的分析。因此本文对二叉树的动态链式存储和静态链式存储进行了全面的介绍,并对其进行了分析研究。  相似文献   

14.
文章介绍了知识发现中关联规则挖掘算法的基本思想及其性能,分析了FP-tree算法在关联规则挖掘中存在耗费巨大空间存贮的问题,提出了一种运用投影技术改进的频繁模式增长算法,该算法改善FP-tree构造,实验结果表明,运用投影技术改进的频繁模式增长算法可以提高关联规则挖掘效果。  相似文献   

15.
李畅畅 《科技信息》2010,(11):27-28
本文介绍了知识发现中关联规则挖掘算法的基本思想及其性能,分析了FP-tree算法在关联规则挖掘中存在耗费巨大空间存贮的问题,提出了一种运用投影技术改进的频繁模式增长算法,该算法大大改善FP—tree构造,实验结果表明,运用投影技术改进的频繁模式增长算法可以大大提高关联规则挖掘效果。  相似文献   

16.
现有的Web日志频繁访问路径挖掘算法往往不能在追求时间效率的同时准确挖掘出符合用户浏览顺序的频繁路径.提出了有效挖掘Web日志中频繁访问路径的算法,将事务数据库转换为Web访问路径树,根据支持度进行剪枝构造最长前缀频繁子路径树,然后进行频繁路径挖掘,实验证实了此方法的有效性,并分析了支持度设置对频繁路径生成的影响.  相似文献   

17.
经典的频繁情节挖掘算法NONEPI及其改进算法NONEPI+存在时空复杂度高、"重复计算"等问题,基于最小且非重叠发生的支持度定义,提出一个基于前缀共享树的频繁情节挖掘算法PST_NONEPI,该算法采用深度优先搜索策略,将发现的频繁情节压缩到前缀共享树中,通过动态维护前缀共享树来发现所有的频繁情节。该算法只需扫描事件序列一次,大大提高了频繁情节挖掘的效率。实验证明,PST_NONEPI算法能有效地挖掘频繁情节。  相似文献   

18.
通过分析与研究广义表与有序树之间的关系和性质,并在相关文献对广义表的研究基础上,提出了基于有序树的广义表表头、表尾、长度和深度的定义,并根据有序树的二叉链表表示法对以上定义进行算法设计.  相似文献   

19.
信息检索及其相关运算广泛应用于计算机信息管理实践中.基于单链表和哈希表两种结构实现动态查找算法为例,探讨商品信息查找的相关算法,说明这些算法的特点,比较分析了它们的时间性能,并从实验角度验证了这些算法时间性能的差异.  相似文献   

设为首页 | 免责声明 | 关于勤云 | 加入收藏

Copyright©北京勤云科技发展有限公司  京ICP备09084417号