首页 | 本学科首页   官方微博 | 高级检索  
相似文献
 共查询到18条相似文献,搜索用时 66 毫秒
1.
基于高斯混合模型GMM的说话人识别方法   总被引:1,自引:0,他引:1  
臧晓昱 《科技信息》2006,2(1):21-17
高斯混合模型(GMM)是一种经典的说话人识别算法,本文在实现其算法的同时,主要模拟了不同噪声环境情况下高斯混合模型(GMM)的抗噪声性能,得到了一些有益结论。  相似文献   

2.
针对现有数字高程模型(DEM,digital elevation model)简化算法对地形变化复杂区域的简化效果不够理想的问题,提出了一种基于高斯混合模型(GMM,Gaussian mixture model)和曲率熵的DEM精简算法。该算法首先根据DEM数据的高程信息对其进行聚类,将体现地形局部几何信息的熵与曲率相结合作为简化指标,针对不同的子类依据曲率熵的大小进行不同程度的精简。GMM聚类算法的引入能够保证各种地形数据在简化的过程中均得到一定程度上的保留,不会在平坦的区域简化过多的数据从而造成数据的不连续性。实验结果表明,与传统的简化算法相比,本文提出的算法具有高精度、数据空洞小、地形保持度高的特点,更加适合结构复杂、变化多样的地形。  相似文献   

3.
基于高斯混合模型的说话人识别系统   总被引:2,自引:0,他引:2  
针对概率得分均值法出现的单个帧概率打分容易畸低的情况以及投票法因归一化而损失掉正面影响帧的打分,提出了一种引入可信度的均值方法,实验证明:该方法兼顾二者的优势的同时,在一定程度上消除了各自产生的不利影响,提高了说话人识别的精度。  相似文献   

4.
为了研究模糊聚类算法在高斯混合模型(GMM)参数获取方面的应用,采用模糊C均值算法(FCM)进行语音特征矢量的聚类,并结合Tabu搜索算法得到全局最优的聚类结果,进一步用EM算法得到GMM模型参数.使用TIMIT数据库中的语音进行测试,开集和闭集说话人辨认实验都表明,该方法获取的GMM参数比普通EM算法获得的GMM模型参数性能更优,能有效降低说话人辨认系统的误识率.  相似文献   

5.
肤色识别是色情图像识别、人脸检测等图像处理技术的关键步骤,肤色识别效果的好坏直接影响相关图像处理技术的效果。图像中存在干扰因素时基于单高斯模型的肤色识别效果不佳,为了解决这个问题,在YCbCr色度空间基础上,提出了基于高斯混合模型自适应肤色识别算法。实验表明该算法识别效率较高,能较好地识别存在干扰因素图像中的肤色,具有一定的实用性。  相似文献   

6.
针对传统的特征参数Mel频域倒谱系数MFCC难以满足语音信号的非平稳性问题,提出一种基于小波分析的新特征参数FPBW的提取方法.为了提高训练速度,采用正交高斯混和模型,将正交变换改到最大期望EM算法之前进行,从而减少训练时间.实验结果表明,新的特征参数FPBW优于特征参数MFCC,并且采用正交高斯混合模型进一步提高了识别性能和训练速度.  相似文献   

7.
茅正冲  王丹  徐昊 《科学技术与工程》2013,13(14):4070-4073,4078
针对传统的混合高斯模型算法检测时存在较多噪声的不足,提出了一种基于混合高斯模型与三帧差法相结合的运动目标检测算法。该算法首先分别通过混合高斯模型算法和三帧差法各获得一幅前景图像,然后将两幅图像进行逻辑或运算;再对获得的图像进行自适应中值滤波处理,并利用连通域阈值面积去噪法除去剩余的噪声,最终提取出运动目标。实验仿真结果表明,利用该方法可以有效地提高运动目标的检测率。  相似文献   

8.
针对背景场景重复显现问题,提出了一种基于历史背景的混合高斯模型(History Background-based GMM,HBGMM).相较于传统的混合高斯模型,该模型对历史背景模型进行标记,并通过判决匹配次数快速调整历史背景模型的学习率.同时对模型权重低于阈值下限历史模型和非历史模型进行区别处理,用该方法更新模型权重从而降低误检率,使历史模型尽量避免误删除.实验结果表明,本文提出的基于历史背景的混合高斯背景模型能够实现记忆背景的功能,从而更快地适应场景的变化,减少前景误判.  相似文献   

9.
一种改进的混合高斯模型运动目标检测方法   总被引:2,自引:0,他引:2  
混合高斯模型是一种能够较好处理光线渐变, 象素点噪声干扰的运动目标检测模型,但在光线突变时,大量背景象素偏离原有的分布模型,会造成大量背景象素点被检测为前景.本文提出了一种新的运动目标检测办法:首先以当前帧和背景帧对应象素亮度比值的概率的分布来判定光照突变,然后依据其分布规律来检测运动目标,最后以检测的结果对混合高斯模型进行修正,使其能快速适应光照突变环境.实验结果表明,该方法能够较好地适应光照突变的环境.  相似文献   

10.
提出一种混合模型,即将隐马尔可夫模型(HMM)和小波神经网络(WNN)相结合应用于说话人识别的模型.该方法利用HMM的时序建模能力以及小波神经网络较强的模式分类能力,进行与文本无关的说话人的识别.实验表明,采用这种混合模型可以提高系统的识别率,特别在噪声环境中具有一定的噪声鲁棒性,提高了识别性能.  相似文献   

11.
与文本无关的复合策略说话人辨识系统   总被引:4,自引:1,他引:4  
为获得较高的说话人辨识正确率,同时减小辨识系统的时空开销,提出了一种复合策略的辨识系统。采用长时平均频谱作为粗识的特征,定义了相应的辨识判别准则。建立mel-倒谱特征的高斯混合模型(GMM)进行第二步辨识。给出了GMM求解算法的一种简便推导,着重研究了判别阈值,预加重系数,GMM阶次,训练语音长度及辨识语音长度对系统辨识性能的影响。  相似文献   

12.
提出利用超声层次上的韵律信息来进行语种辨识.在子词分割的基础上结合元音/辅音检测模型,将语音分割为CnV的假音节模型,然后对每个假音节提取一个五维的特征韵律参数.分割结果比传统的分割方法更接近实际的音节结构.在韵律系统中,对所有的语言建立高斯混合模型(GMM),研究模型的离散度和模型间的干扰程度.实验表明,韵律模型对不同的语言、不同的语系和同一语系中不同语言均具有一定的区分效果.  相似文献   

13.
为提高说话人识别系统的识别率,提出了一种提取Mel频率倒谱系数(MFCC)与差分特征组合参数的方法:先对传统的MFCC参数进行特征分量归一化处理,提升MFCC系数的噪声鲁棒性;再用高斯混合模型(GMM)构建了说话人识别系统。使用TIMIT语音库进行实验测试,并比较了不同高斯混合数的MFCC特征参数组合对识别率的影响。结果表明:使用改进的MFCC混合参数明显地提高了说话人的识别率。  相似文献   

14.
针对距离误差对定位结果的影响,提出一种基于高斯混合模型的无线传感器网络定位算法.该算法将高斯混合模型方法引入到无线传感器网络的定位问题中,通过高斯混合模型分析找出误差较大的距离信息并将其剔除,对剩余距离信息使用三边测量定位法进行定位求解,同时结合加权定位算法进行位置估计.仿真实验结果表明,改进算法能提高定位精度,且定位结果更稳定.  相似文献   

15.
基于G auss ian混合模型的音色变换算法在预测目标说话人频谱时会出现过平滑问题,导致声音转换结果的音质下降。该文分析了造成过平滑问题的原因,并提出一种考虑帧间动态特征的音色变换改进算法,在估计参数的目标函数中加入了连续性和方差的影响,从而改善了映射结果的帧间连续性,并使方差最大化,克服了过平滑现象。实验表明该算法在保证变换结果的目标倾向性的同时,能够使变换语音的音质主观意见得分由3.11提高到3.89,证明动态特征对提高音色变换的音质有重要意义。  相似文献   

16.
针对弹道修正弹在弹道环境下状态估计精度差的问题,利用试验过程中的数据,从弹丸记录仪卫星定位和测速数据与雷达数据中分离出弹丸飞行过程中弹道测量误差序列,使用高斯混合模型(GMM)对误差概率分布进行近似拟合,并对其表述形式进行统一.对传统的高斯混合扩展卡尔曼滤波(GMEKF)算法进行改进,考虑噪声在相邻多个时刻之间的相关性,使用AR模型将有色观测噪声解耦并使用状态扩增法、差分法对有色噪声进行白化处理.以修正弹弹道仿真为例进行算法验证及对比,实验结果证明了改进GMEKF算法在提升弹道参数估计精度以及落点精度的有效性.  相似文献   

17.
基于高斯混合密度函数估计的语音分离   总被引:3,自引:0,他引:3  
基于最大熵法(Maximum Entropy,ME)、最小互信息量法(Minimum Mutual Information,MMI)和最大似然法(MaximumLIkelihood,ML)最解决盲信号分离问题的常用算法,分析了ME、MMI以及ML算法之间关系。基于高斯混合模式(Gaussian Mixture Model,GMM)概率密度函数估计,提出了一种采用反馈结构的扩展最大熵语音分离算法,与  相似文献   

18.
Skin segmentation is widely used in many computer vision tasks to improve automated visualization. This paper presents a graph cuts algorithm to segment arbitrary skin regions from images. The detected face is used to determine the foreground skin seeds and the background non-skin seeds with the color probability distributions for the foreground represented by a single Gaussian model and for the background by a Gaussian mixture model. The probability distribution of the image is used for noise suppression to alleviate the influence of the background regions having skin-like colors. Finally, the skin is segmented by graph cuts, with the regional parameter γ optimally selected to adapt to different images. Tests of the algorithm on many real world photographs show that the scheme accurately segments skin regions and is robust against illumination variations, individual skin variations, and cluttered backgrounds.  相似文献   

设为首页 | 免责声明 | 关于勤云 | 加入收藏

Copyright©北京勤云科技发展有限公司  京ICP备09084417号