首页 | 本学科首页   官方微博 | 高级检索  
相似文献
 共查询到20条相似文献,搜索用时 609 毫秒
1.
情感词典作为情感分析任务中的一项基础资源,是观点发现及情感极性判断的重要依据。随着网络新词的大量出现,情感新词的抽取成为一个亟待解决的问题。针对这一问题提出基于边界特征的情感新词的提取方法。该方法利用skip-gram模型挖掘情感词的边界特征、构建边界特征集,利用边界特征集提取情感新词候选集,通过bigram搭配、序列模式等方法对情感新词候选集进行过滤,根据候选串的频次、与其搭配的边界特征在语料中的分布情况对候选串进行评分。在微博语料上的实验结果显示,该方法对情感新词识别的准确率与候选串得分正相关,当候选串得分为11时准确率为83.33%。实验证明,基于边界特征的情感新词的提取方法能够有效地识别大规模语料中的情感新词。  相似文献   

2.
提出了一种基于支持向量机的中文新词识别算法.该算法结合新词内部模式以及词长等提出了基于词内部模式的改进字符位置似然概率,并综合新词的邻接类别等特征对新词进行识别.经过小说语料测试,实验结果表明:该算法的微F1值为0.583 3,宏F1值为0.775 7,分别比不考虑词内部模式的基准算法提高约63%和30%.  相似文献   

3.
研究评论倾向性分析中情感词的动态极性变化问题.用Apriori算法在语境基础上挖掘情感歧义词语搭配,构建出(情感对象,情感词,情感倾向性)三元组形式的情感歧义词搭配词典,利用条件随机场模型(CRFs)序列标注方法从评论文本中抽取出情感要素,在构建的情感歧义词搭配词典基础上对评论文本进行了细粒度情感倾向性分析.在手机和电脑两个领域的评论语料集上进行多组实验,与传统方法的对比实验表明了方法的可行性,较为明显地提高了情感倾向性分析的准确率.  相似文献   

4.
为进一步提高文本情感倾向性分类效果,提出基于文本特征和语言知识融合的卷积神经网络模型MI-CNN。使用Word2Vec表示词语信息,将词性和情感词语等语言知识嵌入词向量中,将文本特征和语言知识融合到情感倾向性分类模型,经过参数优化提升文本情感倾向性分类模型的准确率。在数据集上进行实验,结果表明所提出的模型准确率达到93.0%,比文献中的基准模型取得了更好的分类效果。  相似文献   

5.
研究第五届中文倾向性分析评测的任务3和任务4,即微博的倾向性分析和评价对象识别.网络新词多,句子格式不规范,语言简短且包含的情感内容多都是微博分析的难点.针对此问题,提出对中文微博的过滤算法.在词语倾向性识别中,构建基础观点词和网络观点词等词典,然后利用知网识别所有词语的倾向性.在评价对象的抽取方面,提出一种面向微博的基于统计和规则相结合的评价对象抽取方法,特别是提出利用句法分析和评价词、评价对象互信息的联合抽取算法.实验表明,该算法可以提升评价对象抽取的效果.  相似文献   

6.
基于互信息改进算法的新词发现对中文分词系统改进   总被引:6,自引:0,他引:6  
提出一种非监督的新词识别方法。该方法利用互信息(PMI)的改进算法--PMIk算法与少量基本规则相结合, 从大规模语料中自动识别2~n元网络新词(n为发现的新词最大长度, 可以根据需要指定)。基于257 MB的百度贴吧语料实验, 当PMIk方法的参数为10时, 结果精度达到97.39%, 比PMI方法提高28.79%, 实验结果表明, 该新词发现方法能够有效地从大规模网络语料中发现新词。将新词发现结果编纂成用户词典, 加载到汉语词法分析系统ICTCLAS中, 基于10 KB的百度贴吧语料实验, 比加载用户词典前的分词结果准确率、召回率和F值分别提高7.93%, 3.73%和5.91%。实验表明, 通过进行新词发现能有效改善分词系统对网络文本的处理效果。  相似文献   

7.
为了解决分布式词表示方法因忽略词语情感信息导致情感分类准确率较低的问题,提出了一种融入情感信息加权词向量的情感分析改进方法。依据专属领域情感词典构建方法,结合词典和语义规则,将情感信息融入到TF-IDF算法中,利用Word2vec模型得到加权词向量表示方法,并运用此方法对采集到的河北省旅游景点的评论文本与对照组进行对比实验。结果表明,与基于分布式词向量表示的情感分析方法相比,采用融入情感信息加权词向量的改进方法进行情感分析,积极文本的准确率提高了6.1%,召回率提高了6.6%,F值达到了90.3%;消极评论文本的准确率提高了6.0%,召回率提高了7.2%,F值达到了89.6%。因此,融入情感信息加权词向量的情感分析改进方法可以有效提高评论文本情感分析的准确率,为用户获得更为准确的评论观点提供参考。  相似文献   

8.
闻彬 《咸宁学院学报》2010,30(6):56-57,64
中文倾向性研究是针对文本内容获得有用的倾向性信息和知识,它已经成为自然语言处理的研究热点.本文首先分析了国内外关于倾向性的研究现状,然后重点介绍了情感词识别和情感词极性判别的方法和技术.同时在对现有的情感词极性判别技术的基础上,提出了一种基于改进的HowNet处理情感词极性判别的方法.实验结果表明,本方法在词语级上达到了较好的效果.  相似文献   

9.
提出了一种基于改进位置成词概率的新词识别算法.该算法在位置成词概率的基础上,结合新词内部模式的特征提出了改进的位置成词概率,然后再综合互信息、邻接类别等统计量对新词进行识别.采用小说语料进行测试,实验结果表明该算法在一定程度上能有效提取新词.  相似文献   

10.
针对基于预训练得到的词向量在低频词语表示质量和稳定性等方面存在的缺陷, 提出一种基于Hownet的词向量表示方法(H-WRL)。首先, 基于义原独立性假设, 将 Hownet中所有N个义原指定为欧式空间的一个标准正交基, 实现Hownet义原向量初始化; 然后, 根据Hownet中词语与义原之间的定义关系, 将词语向量表示视为相关义原所张成的子空间中的投影, 并提出学习词向量表示的深度神经网络模型。实验表明, 基于Hownet的词向量表示在词相似度计算和词义消歧两项标准评测任务中均取得很好的效果。  相似文献   

11.
玉山方言属昊语处衢片,接近南部昊语。玉山方言词汇中有大量的重叠现象存在,这些重叠词是玉山方言词汇不可缺少的重要组成部分。通过与普通话重叠词进行比较,显示了玉山方言重叠词的各种形式及特点。  相似文献   

12.
英语阅读和其它语言阅读一样, 是一个复杂的认知过程, 涉及对字母的认知, 词的知觉与判断以及句子的分析等, 可以说, 词汇是语言的基础材料。作者积自己多年阅读课教学的经验, 从词汇教学入手, 旁征博引, 深入浅出地阐述了词汇在英语教学中的重要地位, 总结出提高阅读课教学质量的五种行之有效的方法, 取得一定实效  相似文献   

13.
根据实际工作,开发了一个自动分词系统,对汉语自动分词技术在智能人机交互中的实现进行探讨.基于系统的情况,分词算法采用了最大匹配法,在词库检索中提出了化查询为直接存取的方法,提高了检索效率,节省了内存,有利于分词速度的提高.  相似文献   

14.
英语重叠词探析   总被引:1,自引:0,他引:1  
从重叠词的形态分类、重叠词的词性特征和句法功能、重叠词的修饰功能等几个方面对英语中的重叠词进行了探讨,发现英语中的重叠词多为开放性词类,俚语和口语体色彩突出,它们在模拟声音、临摹形状、描述动作、传情达意方面具有较强的表达优势。  相似文献   

15.
导游讲解技能竞赛除了选手的表现力外,导游词的创作也十分重要.该文从主题选择、主题升华、互动设置、与时俱进等方面对竞赛型导游词的创作进行浅析.  相似文献   

16.
魏洁 《科技信息》2008,(31):273-273
This paper mainly discusses the openness and assimilation of the words system from the viewpoint of loan words between English and Chinese.Both the history of loan words and the ways of borrowing words in English and Chinese have shown us the strong abilities of languages.  相似文献   

17.
词汇的积累和扩大是英语学习者最感困难的问题之一,也是英语教学中教师关注的焦点。结合英语的教学实际,对英语词汇中常见的否定前缀的来源、含义、构成和用法等进行了辨析。  相似文献   

18.
语言的民族性体现在语言系统的各个层面,文字是这个系统的基础和根本。选取汉英两种文字,从文字特征与民族思维的关系角度对比汉英民族思维差异在各自文字上的反映,即汉英民族思维差异的文字印迹。  相似文献   

19.
 随着网络信息的迅速发展,搜索引擎已成为人们获取有用信息必不可少的工具.采用何种策略有效地访问网络资源是搜索引擎研究的主题.主要对搜索引擎中涉及的Web知识树的结构及设计方法进行了介绍.  相似文献   

20.
从汉字构形本身出发,对与之相关的"日、月"时间字形资料进行系统地分析考查,从而揭示出汉先民传统的时间观。  相似文献   

设为首页 | 免责声明 | 关于勤云 | 加入收藏

Copyright©北京勤云科技发展有限公司  京ICP备09084417号