基于排序学习的文本概念标注方法研究 Learning to Rank Concept Annotation for Text期刊界 All Journals 搜尽天下杂志传播学术成果专业期刊搜索期刊信息化学术搜索

按检索

基于排序学习的文本概念标注方法研究

引用本文：	涂新辉,何婷婷,李芳,王建文.基于排序学习的文本概念标注方法研究[J].北京大学学报(自然科学版),2013,49(1):153-158.

作者姓名：	涂新辉何婷婷李芳王建文

作者单位：	1. 华中师范大学计算机学院, 武汉 430079; 2. 国家语言资源监测与研究中心网络媒体语言分中心, 武汉 430079;

基金项目：	国家自然科学基金(90920005,61003192)资助

摘要：	提出一种基于排序学习的方法CRM (concept ranking model), 来实现文档的维基百科概念自动标注。首先人工对一定规模的文档进行概念标注, 建立训练集合, 然后利用排序学习算法在多项特征上得到对概念排序的模型, 利用这个概念的排序模型对任意文档进行概念标注。实验表明, 相对于传统的文档概念标注方法, 此方法在各类指标上都有相当大的提高, 标注结果更加接近人类的概念标注。
关键词：	概念标注排序学习维基百科显示语义分析
收稿时间：	2012-05-31
Learning to Rank Concept Annotation for Text

TU Xinhui,HE Tingting,LI Fang,WANG Jianwen.Learning to Rank Concept Annotation for Text[J].Acta Scientiarum Naturalium Universitatis Pekinensis,2013,49(1):153-158.

Authors:	TU Xinhui HE Tingting LI Fang WANG Jianwen

Institution:	1. School of Computer Science, Huazhong Normal University, Wuhan 430079; 2. Network Media Branch, National Language Resources Monitoring and Research Center, Wuhan 430079;

Abstract:	This paper proposed an automatic text annotation method (CRM, concept ranking model) based on learning to ranking model. Firstly the authors built a training set of concept annotation manualy, and then used the Ranking SVM algorithm to generate concept ranking model, finally the concept ranking model was used to generate concept annotation for any texts. Experiments show that proposed method has a significant improvement in various indicators compared to traditional annotation methods, and concept annotation results is closer to human annotation.

Keywords:	concept annotation learning to ranking Wikipedia explicit semantic analysis
本文献已被 CNKI 万方数据等数据库收录！
	点击此处可从《北京大学学报(自然科学版)》浏览原始摘要信息
	点击此处可从《北京大学学报(自然科学版)》下载免费的PDF全文

设为首页 | 免责声明 | 关于勤云 | 加入收藏