一种适用于高维非线性特征数据的聚类算法及应用 A Clustering Algorithm for High-Dimensional Nonlinear Feature Data with Applications期刊界 All Journals 搜尽天下杂志传播学术成果专业期刊搜索期刊信息化学术搜索

按检索

一种适用于高维非线性特征数据的聚类算法及应用

作者单位：	;1.西安交通大学机械制造系统工程国家重点实验室;2.西安交通大学第二附属医院

摘要：	针对高维数据聚类分析中数据之间具有多种非线性特征关系,导致数据分布不均、传统相似性度量失效及结果类中心难以精准表征等问题,提出了一种基于核主元分析(KPCA)与密度聚类(DBSCAN)的高维非线性特征数据聚类分析技术。首先,为有效提取高维数据的非线性特征,利用KPCA理论将原始数据映射到更高维数据空间,利用主元分析获得数据变化的方向集合,并进行降维分析;然后,通过重新定义数据样本在主元空间的相似性距离对传统DBSCAN聚类方法进行改进,并利用3δ统计理论对各簇中心的进行表征,从而实现高维数据的精确分类与类中心知识表达。以实际高血压患者群体聚类问题为例对方法进行了有效性验证,实验表明,所提方法可以有效获取原始数据的非线性特征,实现患者个体特征群体的有效划分及簇类中心知识的表达,解决传统DBSCAN聚类方法对高维数据不适用的问题。
关键词：	非线性高维数据核主元分析密度聚类
A Clustering Algorithm for High-Dimensional Nonlinear Feature Data with Applications

Abstract:

Keywords: