首页 | 本学科首页   官方微博 | 高级检索  
相似文献
 共查询到17条相似文献,搜索用时 60 毫秒
1.
基于后验概率的Markov逻辑网参数学习方法   总被引:1,自引:0,他引:1  
通过介绍统计关系学习方法Markov逻辑网的理论模型和参数学习方法, 提出一种基于后验概率的参数估计方法, 该方法采用正态先验分布, 用伪似然概率替代似然概率, 通过最大化伪后验概率来学习模型参数. 实验结果表明, 该方法能够有效地学出模型参数, 且所得模型推理能力优于现有的参数学习方法.  相似文献   

2.
通过介绍统计关系学习方法Markov逻辑网的理论模型和参数学习方法, 提出一种基于后验概率的参数估计方法, 该方法采用正态先验分布, 用伪似然概率替代似然概率, 通过最大化伪后验概率来学习模型参数. 实验结果表明, 该方法能够有效地学出模型参数, 且所得模型推理能力优于现有的参数学习方法.  相似文献   

3.
在传统的监督学习任务中,实体被认为是独立同分布的.然而,现实世界中实体之间通过复杂的方式相互关联.例如在超文本分类中,具有链接关系的页面之间高度相关.标准的分类方法是忽略实体之间的联系,对每个实体单独分类.本文将Markov逻辑网应用到超文本分类中,旨在改善这一问题.实验结果显示了采用Markov逻辑网模型要比采用K最邻近节点算法的分类效果好;同时将实体之间存在的联系用于学习和推理对于分类也有一定的贡献.  相似文献   

4.
针对重复数据删除系统中存储容量受内存限制难以进行扩展的问题,提出了一种基于无向图遍历的重复数据删除分组预测方法.该方法将索引表保存在磁盘中,并在内存中维护索引表缓存,以此提高系统最大可支持的存储容量.对于索引表缓存命中率低、系统性能差的问题,采用了图遍历分组方法予以解决,根据数据块访问序列特征信息建立无向图并进行分析,基于分析结果对索引项进行分组,并以组进行缓存替换,从而提高缓存命中率和系统性能.实验结果表明,基于缓存预取原理和无向图遍历分组,在将缓存设置为索引表大小的10%时,重复数据删除存储系统最大存储容量比原有方法提高了7.5倍,缓存命中率由不进行索引项分组时的47%提高到87.6%.  相似文献   

5.
基于Markov逻辑网的句子压缩方法   总被引:1,自引:0,他引:1  
提出了一种基于Markov逻辑网通过删除单词进行英文句子压缩的方法。通过一阶逻辑公式表示单词的局部特征以及单词之间的相互依赖关系,确定单词是否应该删除。与现有方法相比,该方法把判别式学习和整数规划的优点相结合,既融合了丰富的句子特征,又以逻辑公式方便地表示全局约束。在书面和口语两个新闻数据集上的实验结果表明:该方法与L3和SVTL系统相比具有明显优势,在压缩率接近时,以人工压缩结果为评测标准,压缩后句子的依存关系F-score有较大提高。  相似文献   

6.
根据重复数据删除的特点,针对连续数据访问为主的应用,设计基于B+树的元数据索引结构;将元数据分为冷热两种,分别设计不同的元数据布局策略。研究结果表明,低能耗磁盘能够保持更长时间的待机状态以便节能,同时可以有效地减少重复数据删除时的随机磁盘访问次数。并且没有额外的硬件开销,实现仅在磁盘上存储索引,而不是之前研究中的在磁盘和内存中存储索引。   相似文献   

7.
针对系统中存在的索引检索效率问题,提出了一种基于时序参数的快速索引优化算法,该算法通过时间参数和序数参数获取数据块的热度值,将高热度值的数据块指纹组合成了一个高优先度的快速索引.快速索引与主索引组成了重复数据删除中的两层索引结构,从而提高了系统的检索性能.通过实验验证了基于时序参数的索引优化算法的优越性.  相似文献   

8.
针对当今企业海量数据的增长给数据容灾系统的存储容量、处理能力、数据传输带宽带来巨大压力的现状,设计了一种基于重复数据删除技术的数据容灾系统.通过I/O吞吐量、CPU利用率、响应时间、数据备份时间和重复数据删除率等指标对数据容灾系统性能进行了测试,测试结果表明数据容灾系统对应用服务器响应时间的影响甚小,重复数据删除效果显著.  相似文献   

9.
针对基于内容分块重复数据删除方法缺少能够定量分析预期分块长度与重复数据删除率之间关系的数学模型,导致难以通过调整预期分块长度优化重复数据删除率的问题,提出了一种基于Logistic函数的数学模型。在大量真实数据测观察基础上,提出了通过Logistic函数描述非重复数据的S形变化趋势,解决了该数据难以从理论上推导、建模的问题,证明了基于内容分块过程服从二项分布,并从理论上推导出了元数据大小模型。基于上述两种数据模型,通过数学运算最终推导得到重复数据删除率模型,并利用收集到的3组真实数据集对模型进行了实验验证。实验结果表明:反映数学模型拟合优度的R2值在0.9以上,说明该模型能够准确地反映出预期分块长度与重复数据删除率之间的数学关系。该模型为进一步研究如何通过调整预期分块长度使重复数据删除率最优化提供了理论基础。  相似文献   

10.
针对海量数据中存在的大量冗余信息,本文设计并实现了一种基于重复数据删除的文件备份与恢复系统,该系统采用改进的Winnowing动态分块算法,将文件分割成不同长度的数据块,并结合摘要算法、索引表、数据压缩等技术,确保服务器仅存储数据块唯一副本,以达到重复数据的删除目的.实验表明,该系统相比cwRsync能较更好的减少网络流量,并且相比传统的压缩技术能更进一步减少磁盘空间占用率.  相似文献   

11.
在归纳逻辑编程研究的基础上, 给出了概率逻辑学习的一种形式化定义框架. 根据不同概率逻辑学习方法在实例表示和概率定义上的不同, 讨论了3种概率逻辑学习框架: 解释学习、 证明学习和蕴涵学习; 并据此对现有的典型概率逻辑学习方法和系统进行了分析和概述.  相似文献   

12.
在归纳逻辑编程研究的基础上, 给出了概率逻辑学习的一种形式化定义框架. 根据不同概率逻辑学习方法在实例表示和概率定义上的不同, 讨论了3种概率逻辑学习框架: 解释学习、 证明学习和蕴涵学习; 并据此对现有的典型概率逻辑学习方法和系统进行了分析和概述.  相似文献   

13.
利用基于粗糙集理论的统计关系学习方法, 解决了统计关系学习中归纳逻辑程序设计方法的不确定性问题, 并改进了粗糙集结合归纳逻辑程序设计的系列模型, 从而得到更加准确的模型体系定义. 改进后的模型系列更合理完善.  相似文献   

14.
机器学习研究   总被引:28,自引:15,他引:28  
由于Internet的使用,不分时间与地域地获得信息已成为现实,但是,如何有效利用这些信息,并使用这些信息提高生产率成为迫切需要解决的问题.机器学习是解决这类问题的有效方法之一.在此将对目前机器学习研究的主要趋势、理论与技术以及存在的问题,根据作者的研究经验进行综述,以便引起研究者的注意.  相似文献   

15.
通过将正则化框架引入到统计学习中来,介绍了几种当前流行的统计学习机器,分析了他们的性能,并探讨了快速求解算法.  相似文献   

16.
Web信息提取中多策略学习算法的研究   总被引:1,自引:1,他引:1  
将一种新的机器学习方法-多策略学习算法应用于Web信息提取领域,在原有的机械学习,统计学习和相关学习等三种机器学习法基础之上充分考虑各学习方法的利弊,将三者有机结合,使得结合后的新算法在提取Web信息时比结合前任一单一机器学习方法都更有效、更准确。  相似文献   

17.
支持向量机的学习方法综述   总被引:8,自引:0,他引:8  
支持向量机是一种基于统计学习理论的新型机器学习方法,由于其出色的学习性能,已经成为当前机器学习界的研究热点.详细总结了支持向量机的学习方法,其学习方法主要分为3大类:分解算法、多变量更新算法和序列算法,比较了它们的优缺点;最后指出了学习算法的研究方向.  相似文献   

设为首页 | 免责声明 | 关于勤云 | 加入收藏

Copyright©北京勤云科技发展有限公司  京ICP备09084417号