首页 | 本学科首页   官方微博 | 高级检索  
     检索      

基于CRF的网页动态关系抽取研究
引用本文:张奇,金培权,岳丽华.基于CRF的网页动态关系抽取研究[J].中国科学技术大学学报,2010,40(11).
作者姓名:张奇  金培权  岳丽华
基金项目:国家重点实验室开放课题,国家自然科学基金,北京市"现代信息科学与网络技术"重点实验室暨铁道部"铁路信息科学与工程"开放实验室开放基金
摘    要:提出了基于条件随机场(conditional random fields,CRF)的网页动态关系抽取算法.给出了动态关系的定义,建立了动态关系的表示模型,并用一个六维结构来表达动态关系.与传统关系抽取中基于规则或者基于分类的解决方法不同,本文认为可以将动态关系识别问题转化为一个标注问题,并提出了基于CRF的句子层面的关系标注和抽取方法.在本算法中,首先将一个句子通过语义角色标注(semantic role labeling,SRL)系统进行成分识别,然后将语义角色标注结果以及词的POS类型、词组的命名实体类型等作为CRF的训练特征,对句子成分进行标注.最后测试了大量的真实新闻网页,实验结果表明了本文提出算法的实用性和有效性.

关 键 词:条件随机场  关系抽取  语义角色标准

CRF based dynamic relations extraction from web
ZHANG Qi,JING Peiquan,YUE Lihua.CRF based dynamic relations extraction from web[J].Journal of University of Science and Technology of China,2010,40(11).
Authors:ZHANG Qi  JING Peiquan  YUE Lihua
Abstract:
Keywords:
本文献已被 CNKI 万方数据 等数据库收录!
设为首页 | 免责声明 | 关于勤云 | 加入收藏

Copyright©北京勤云科技发展有限公司  京ICP备09084417号