融合跨语言特征的柬埔寨语命名实体识别方法 |
| |
引用本文: | 徐广义,严馨,余正涛,周丽华.融合跨语言特征的柬埔寨语命名实体识别方法[J].云南大学学报(自然科学版),2018(5). |
| |
作者姓名: | 徐广义 严馨 余正涛 周丽华 |
| |
作者单位: | 云南南天电子信息产业股份有限公司;昆明理工大学信息工程与自动化学院;云南大学信息学院 |
| |
摘 要: | 为了解决柬埔寨语词法标注语料稀缺、柬埔寨语命名实体缺乏明显标识特征的问题,提出一种引入英柬跨语言特征的柬埔寨语命名实体识别方法.首先,借助英语命名实体的成熟模型及英柬双语平行语料的词对齐关系,将源语言的实体类别映射到目标语言;然后根据柬埔寨语词向量构造最近邻图,采用标签传播算法,获得柬埔寨语单词的实体类别分布,完成跨语言知识转移;最后,将柬埔寨语单词的命名实体类别分布作为约束特征融入到条件随机场模型中.实验结果表明,融入跨语言特征的条件随机场模型能有效地提升柬埔寨语命名实体识别的效果.
|
本文献已被 CNKI 等数据库收录! |
|