首页 | 本学科首页   官方微博 | 高级检索  
相似文献
 共查询到20条相似文献,搜索用时 46 毫秒
1.
【目的】针对k-Means聚类算法及MinMax k-Means聚类算法需要人为提前给定聚类数量而导致数据划分准确率偏低以及MinMax k-Means算法聚类效果受类簇边缘点影响较大等不足提出解决方案。【方法】将k-Means和MinMax k-Means算法的目标函数相结合,建立多目标优化模型,提出基于多目标优化方法的k-Means算法。分析簇数异常情况下最小中心方差与最大簇内方差之间的关系。【结果】发现当分类簇数大于最优簇数时,最小中心方差小于最大簇内方差,据此提出了基于多目标优化方法的k-Means自适应算法。【结论】数值实验表明:提出的自适应算法在人工数据集和UCI标准数据集均具有较好的自适应性且聚类效果较优。  相似文献   

2.
聚类是对数据对象的集合无指导地进行分组,聚类算法的好坏直接影响聚类的效果。聚类分析应用广泛,既能作为一个独立的工具来进行数据分析,也可以作为其它算法的预处理步骤。本文从经典的k-Means聚类算法出发,分析了它存在的不足,提出了两种改进的k-Means聚类算法,并从理论上分析了这两种算法可以很好的提高聚类的效果。  相似文献   

3.
针对聚类算法在入侵检测应用中存在的参数预设、聚类有效性评价、未知攻击类型检测等问题,提出了一种基于密度和最优聚类数的改进算法,根据样本的分布情况启发式地确定初始聚类中心,从样本的几何结构角度提出一种新的内部评价指标,给出了最优聚类数确定方法,在此基础上,设计了一个增量式的入侵检测模型,实现了聚类中心和聚类数目的动态调整.实验结果表明,与K-means及其他两种改进聚类算法相比,新算法收敛速度更快、聚类准确率更高,能够对未知网络行为进行有效聚类,具有较好的入侵检测效果.  相似文献   

4.
灰色规划聚类及其在油气盖层评价中的应用   总被引:2,自引:0,他引:2  
分析了现有主要灰色聚类模型的优缺点,论证了灰色聚类原模型的机理.针对一些灰聚类模型的不足,提出了一种改进的灰聚类模型--灰色规划聚类.将灰色规划聚类模型应用于油气盖层评价,从而导出了基于灰聚类分析的盖层定量评价的新方法.该方法适用于较少数据的情形,是一种客观的综合定量评价方法.应用灰色规划聚类盖层评价新方法对琼东南盆地3个主要勘探区4套泥岩共12种盖层对象进行了评价.评价结果与崖13-1大气田和崖21-1发现油气显示等勘查结果相吻合.图1,表5,参13.  相似文献   

5.
针对原始谱聚类初始敏感的缺点,构造了图像聚类质量的评价函数,提出了一种新颖的基于入侵性杂草优化的图像聚类算法(CIWO)。算法模拟杂草克隆的鲁棒性、适应性和随机性等特点,简单易于实现,具有快速精确地对图像灰度数据集的簇中心进行全局定位能力。将算法应用于几个测试图像,并通过聚类有效性准则与k-Means、FCM、PSO等方法比较分析CIWO具有更稳定的图像聚类性能,实验结果表明提出的算法得到了更优的图像聚类质量。  相似文献   

6.
在模糊C-均值聚类(FCM)目标函数的基础上按聚类中心分离原则增加一个聚类中心分离项来扩展FCM算法,提出基于聚类中心分离的模糊聚类模型(FCM_CCS)。该模型可使聚类过程中的聚类中心之间距离扩大,从而得到更好的聚类效果。由于该模型和FCM一样对噪声敏感我们提出它的可能性聚类模型(PCM_CCS),最后进一步扩展成它的可能性模糊聚类模型(PFCM_CCS)。基于聚类中心分离的可能性模糊聚类模型在处理噪声数据和克服一致性聚类问题方面表现出良好的性能。对数据集的测试实验结果表明了提出的PFCM_CCS能同时产生模糊隶属度和典型值,使聚类中心间距扩大,同时具有更好的聚类准确率。  相似文献   

7.
为了提高配送效率,需要更好地规划配送路线,通过建立配送路径最优化模型,使用聚类—遗传算法对其求得配送路径的最优解,聚类—遗传算法采用新的染色体编码方式和交叉原则,相较传统遗传算法,迭代收敛速度更快,且呈现出更优的结果,使得区域配送路径路线最短、成本最低。  相似文献   

8.
基于集成学习的思想,提出一种分布式聚类模型.该模型的分布式处理过程分为2个阶段:先在局部站点局部聚类,然后在全局站点全局聚类.局部站点的局部聚类看作是一种基于数据子集的学习过程,所有的局部聚类结果组成了聚类集成系统的个体学习器,全局聚类采用平均法对局部结果进行集成,并定义了一个准则函数来度量集成的精度.把K-means算法推广到分布式环境,提出一种基于该模型的分布式K均值算法DK-means,该算法对局部数据的分布有较强的伸缩性.实验结果表明,DK-means在同等条件下能达到集中式聚类的精度水平,是有效可行的,从而验证了基于集成学习的分布式聚类模型的有效性.  相似文献   

9.
区域能源系统中能源站选址和管网布局规划是影响区域能源系统经济性的重要因素.综合考虑能源站选址、管网布局与负荷分布的特点,提出了基于聚类和最短路径算法的站网布局优化方法.首先,将最短路径权重作为聚类相似性度量,建立站网布局结构模型.然后以系统年均经济成本最小为目标,构架优化目标函数.最后以实际工程案例进行仿真分析,验证了该方法的有效性.所提出的方法可以对区域内能源站数量、选址以及管网布局进行综合优化,为区域能源系统站网布局规划提供理论参考.  相似文献   

10.
程慈  柴瑞敏 《科技信息》2008,(14):143-143
对聚类分析中聚类数的确定问题进行了研究。在SOFM神经网络的基础上,从聚类准则出发,通过试验对聚类准则的曲线特征进行了详细的分析和论证,设计出一种结构自适应的聚类神经网络,该网络能自动确定最佳的聚类数,并提出了一种减少计算量的改进算法。  相似文献   

11.
博客聚类是处理博客信息的有效方法,提出基于评论修正的博客页面聚类算法.首先分析博客所包含的信息层次结构,然后利用博客页面的通用属性构建博客属性模型,基于博客属性模型对博客页面进行聚类,并且在初次聚类的基础上利用博文的评论对聚类结果进行修正.采用通用的熵和纯净度来衡量聚类结果,根据评论利用方式的不同,设计了两种实验方案:一个实验直接使用评论参与聚类,另一个将评论作为聚类后的修正手段.实验结果对比表明,在大多数情况下,利用评论作为修正手段的聚类效果要优于直接利用评论参与聚类.  相似文献   

12.
基于入侵性杂草克隆的图像聚类方法   总被引:2,自引:0,他引:2  
针对原始谱聚类初始敏感的缺点,提出了一种新的基于入侵性杂草优化(IWO)的图像聚类方法(CIWO).该算法通过计算峰值信噪比(PSNR),动态确定图像聚类簇数的最优选择范围,采用最小量差、最小簇内距离、最大簇间距离重新构造了图像聚类质量的评价函数,通过模拟杂草克隆的自然行为对图像数据集的簇中心进行快速准确定位.将算法应用于几个基准测试图像,并通过聚类有效性准则与k-Means、FCM、PSO等方法进行比较,发现CIWO具有更稳定的图像聚类性能.实验结果也表明,所提出的算法可获得更优的图像聚类质量.  相似文献   

13.
为了提高噪声污染数据的聚类效果及质量,提出了一种基于k-Means均匀效应的健壮聚类初始化算法.k-Means聚类结果中各子簇样本量均匀一致,导致其中稀疏子簇范围大、稠密子簇范围小以及相邻稠密子簇范围相当等关系.算法利用超过实际聚类数的k-Means算法,以便获得上述子簇范围关系,通过合并邻近小子簇、丢弃稀疏的大子簇,自动获得相似样本簇并有效地消除噪声,从而实现健壮的聚类初始化.理论和实验证明了该算法的有效性.  相似文献   

14.
针对临床路径决策分析聚类算法中聚类效果依赖于样本数据分布且处理数据效率低的问题,提出基于均衡分配方法的模糊K-means算法的临床路径决策方法.该算法利用文字数字化处理与加权计算来建立数据格式统一且关键属性突出的样本特征值矩阵;利用基于均衡分配方法的模糊K-means算法对上述样本进行聚类分析,得到最终的聚类中心与聚类结果,以此辅助医生进行临床路径决策.采用ECLIPSE编程进行仿真,与传统模糊K-means算法和基于减法聚类的FCM算法相比,采用该算法的迭代时间分别降低了26%与70%,迭代次数分别减少了33%和82%,平均目标函数最小值分别减小了32%和28%.实验表明,该算法能够有效降低聚类效果对于样本数据分布的依赖,同时数据聚类效率与质量也有显著的提高.  相似文献   

15.
针对传统K-means算法的聚类结果依赖初始聚类中心的缺陷,提出了一种基于密度的改进K-means聚类算法,该算法选择位于数据集样本密集区且相距较远的数据对象作为初始聚类中心,实现K-means聚类。针对PAM算法时间复杂度高,且不利于大数据集处理的缺陷,提出了一种基于密度的改进K-medoids聚类算法,在选取初始中心点时根据数据集样本的分布特征选取,使得初始中心点位于不同类簇。UCI机器学习数据库数据集和随机生成的带有噪音点的人工模拟数据集的实验测试证明,基于密度的改进K-means算法和基于密度的改进Kmedoids算法都具有很好的聚类效果,运行时间短,收敛速度快,有抗噪性能。  相似文献   

16.
本文提出了一种基于遗传算法,结合网站的拓扑结构,对网站用户进行聚类分析的模型,阐述了遗传算法在优化过程中染色体编码、遗传算子的设计等问题.实验证明能解决常规聚类算法不能有效处理局部极值、聚类结果对初始聚类中心的选取有着很大的敏感性的问题,是一种有实用价值的方法.  相似文献   

17.
为解决群智采集的指纹数据量较大且分布状况复杂的问题,提出了一种基于AP聚类算法的指纹库建立及优化算法.通过AP聚类算法将位置接近且相似度较高的指纹聚成一类,相较于其他聚类算法,使用AP聚类可以更好地反映当前指纹的分布状况.对聚类生成的每一类指纹建立莱斯分布模型,以莱斯分布模型的参数作为指纹.仿真结果表明基于AP聚类的方法与传统指纹法在具有相似的定位效果的前提下,前者所占用的存储量只有后者的50%.  相似文献   

18.
依据《全国主体功能区规划》提出的新的主体功能区概念体系,并结合区域地理环境和经济发展情况,构建新的主体功能区划分指标体系.分别运用K-均值聚类和系统聚类两种方法进行主体功能区的类型识别,并运用指数评价法和主导因素法对两种聚类法的结果进行分析,得出最合理的主体功能区划分方案.  相似文献   

19.
建立快速有效的针对大规模文本数据的聚类分析方法是当前数据挖掘研究和应用领域中的一个热点问题.为了同时保证聚类效果和提高聚类效率,提出基于"互为最小相似度文本对"搜索的文本聚类算法及分布式并行计算模型.首先利用向量空间模型提出一种文本相似度计算方法;其次,基于"互为最小相似度文本对"搜索选择二分簇中心,提出通过一次划分实现簇质心寻优的二分K-means聚类算法;最后,基于MapReduce框架设计面向云计算应用的大规模文本并行聚类模型.在Hadoop平台上运用真实文本数据的实验表明:提出的聚类算法与原始二分K-means相比,在获得相当聚类效果的同时,具有明显效率优势;并行聚类模型在不同数据规模和计算节点数目上具有良好的扩展性.  相似文献   

20.
一种基于密度的分布式聚类算法   总被引:1,自引:0,他引:1  
对基于密度的分布式聚类算法DBDC(density based distributed clustering)进行改进,提出了一种基于密度的分布式聚类算法DBDC*.该算法在局部筛选代表点时结合贝叶斯信息准则BIC,得到少量精准反映局部站点数据分布的BIC核心点,有效降低了分布式聚类过程中的数据通信量,全局聚类时综合考虑了各站点数据的分布情况.实验结果表明,算法DBDC*的效率优于DBDC,聚类效果好.  相似文献   

设为首页 | 免责声明 | 关于勤云 | 加入收藏

Copyright©北京勤云科技发展有限公司  京ICP备09084417号