首页 | 本学科首页   官方微博 | 高级检索  
     检索      

文本分类中基于核的非线性判别
引用本文:刘海峰,姚泽清,刘守生,王倩.文本分类中基于核的非线性判别[J].应用科学学报,2008,26(6):627.
作者姓名:刘海峰  姚泽清  刘守生  王倩
作者单位:1. 解放军理工大学 理学院,江苏 南京 210007; 2. 徐州工程学院,江苏 徐州 221116
基金项目:国家自然科学基金资助项目  
摘    要:针对文本分类问题中的特征降维问题,改进最大散度差鉴别准则,引入核变换作为前处理,使最大散度差鉴别准则可适用于更广泛的文本分类情形. 提出一种基于核的非线性鉴别方法用于文本特征抽取. 借助于核变换解决了散度差准则在用于文本分类时线性可分性较差的问题. 在最低限度减少信息损失的前提下实现了特征维数的大幅度减缩. 文本分类试验结果表明,这种非线性方法与无核的最大散度差方法相比,F1值提高了4.7%, 具有明显的效率上的优势.

关 键 词:文本分类  特征抽取  散度差  核变换  
收稿时间:2008-06-16
修稿时间:2008-09-09

Kernel-Based Nonlinear Discriminant Method in Text Classification
LIU Hai-feng,YAO Ze-qing,LIU Shou-sheng,WANG Qian.Kernel-Based Nonlinear Discriminant Method in Text Classification[J].Journal of Applied Sciences,2008,26(6):627.
Authors:LIU Hai-feng  YAO Ze-qing  LIU Shou-sheng  WANG Qian
Institution:1.Institute of Sciences, PLA University of Science and Technology, Nanjing 210007, China; 2.Institute of Xuzhou Engineering, Xuzhou 221116, China
Abstract:To achieve feature reduction in text categorization, the scatter difference criterion is improved to satisfy a broad range of text categorization problems using kernel commutation in the pre-treatment. A kernel-based nonlinear method is proposed to extract features. By kernel commutation, the stylebook categorization problem is solved with less linear separability. Dimension of the feature space is significantly reduced without incurring excessive information loss. Experiments show that performance of the proposed method is better than maximal scatter difference with an efficiency improvement of 4.7% for the value of F1.
Keywords:text categorization  feature extraction  scatter difference  kernel commutation  
本文献已被 维普 万方数据 等数据库收录!
点击此处可从《应用科学学报》浏览原始摘要信息
点击此处可从《应用科学学报》下载免费的PDF全文
设为首页 | 免责声明 | 关于勤云 | 加入收藏

Copyright©北京勤云科技发展有限公司  京ICP备09084417号