北京市教委科技发展计划(KM200710005001)
- 作品数:12 被引量:72H指数:5
- 相关作者:鲍长春李如玮窦慧晶郭莉莉罗亚飞更多>>
- 相关机构:北京工业大学更多>>
- 发文基金:北京市教委科技发展计划北京市自然科学基金国家自然科学基金更多>>
- 相关领域:电子电信更多>>
- 基于DCT分带谱熵与信号分解的高精度基音检测算法被引量:6
- 2007年
- 本文就低速率WI语音编码中的基音检测技术进行研究,针对基音检测在不同噪声与信噪比下容易发生清浊误判的问题,在基音检测前端引入基于DCT分带谱熵的语音检测算法划分语音段与非语音段;为了向基音检测算法提供更能准确反映基音周期实际变化的输入语音,基于谐波-噪声模型提出了一种改进的DCT域语音分解算法.然后,根据变形的MCAMDF(Modified Circular Average Magnitude Difference Function)与NCCF(Normalized Cross-Correlation Function)的峰值共性,结合上述两项基音检测前端处理技术,提出了MCAMDF-NCCF基音检测组合算法.为了满足不同环境下WI编码器对基音检测高精度的要求,在合成端更准确地恢复相位轨迹,本文又基于MCAMDF-NCCF算法提出了高精度MCAMDF-NCCF-FRAC基音检测算法以计算分数基音.将算法应用与2kb/s WI编码器,主观A/B听力测试结果表明,本文提出的基音检测算法在低信噪比下明显抑制了基音加倍减半及清浊误判现象的发生,得到了优异的基音检测结果,合成语音质量完全满足低速率WI编码器对基音检测技术的要求.
- 罗亚飞鲍长春
- 关键词:语音编码基音检测语音检测信号分解波形内插
- 基于双正交小波包分解的自适应阈值语音增强被引量:16
- 2008年
- 传统的小波去噪算法是一种有效的去除白噪声的算法,为了能够去除多种有包噪声,本文提出了基于双正交小波包分解的自适应阈值语音增强方法,该方法能够自适应地跟踪噪声的水平,以此来更新所选阈值,同时采用动态阈值方法去除噪声,从而能有效地去除或降低多种有色噪声,实验结果表明,该方法由于能够在处理过程中保证相位不失真,从而性能优于基于正交小波分解的去噪方法。
- 李如玮鲍长春窦慧晶
- 关键词:语音增强小波变换自适应阈值
- 基于分带谱熵和小波域Teager能量的语音清浊分类算法被引量:1
- 2009年
- 基于分带谱熵和小波域Teager能量提出了一种改进的语音清浊分类算法.该算法首先计算频域内的分带谱熵,然后在小波域计算不同频带的Teager能量,计算出低频能量所占的比例,通过这2个参数进行清浊判断.实验结果证明,由于分带谱熵能加深清浊音之间的差异,Teager能量能快速跟踪声门周期内信号能量的变化,因此该算法更容易提取浊音,在纯净语音和含噪语音上的性能都优于幅度能量算法.
- 李如玮鲍长春窦慧晶
- 关键词:语音分类小波变换
- 基于非负矩阵分解的2kb/s波形内插语音编码算法被引量:5
- 2008年
- 在波形内插(Waveform Interpolation,WI)语音编码器中,如何低延时、高精度并且低复杂度的分解和量化特征波形(Characteristic Waveform,CW)一直是该编码模型的研究热点和难点.本文提出用非负矩阵分解(Non-negative MatrixFactorization,NMF)方法来分解语音特征波形.该分解方法仅需要当前帧的语音信号,不会给编码器带来额外的延时;为了提高分解精度,本文在CW分解之前先对CW按照其子帧的最大基音周期进行分类,然后按不同类别进行分解.另外,本文结合耳蜗模型提出了NMF的基矢量分带初始化算法,将CW的分解精度提高到与二阶奇异值分解相当的水平;为了降低WI编码器的计算复杂度,本文去除了传统WI编码器中的特征波形对齐模块,同时将NMF的分解阶数设定为16以折中CW分解的计算复杂度和分解精度.最后,本文基于矩阵量化技术,对非负矩阵分解后的编码矩阵采用分裂式矩阵量化方案来量化.主观A/B测试表明,本文提出的2kb/s NMF-WI编码器的合成语音质量接近于2.4kb/s SVD-WI编码器.MOS分测试表明,本文提出的2kb/s NMF-WI编码器的合成语音质量稍差于2.4kb/s MELP编码器.
- 张鹏鲍长春郭莉莉
- 关键词:语音编码波形内插特征波形非负矩阵分解
- 基于二维非负矩阵分解的1kb/s WI语音编码算法被引量:3
- 2010年
- 本文针对波形内插(WI)语音编码模型和参数量化等技术进行了研究,并最终提出了一种基于二维非负矩阵分解的1kb/s波形内插(2DNMF-WI)语音编码算法.文中采用二维非负矩阵分解(2D-NMF)方法来分解语音特征波形(CW),该分解方法在行和列两个方向上同时压缩CW幅度谱矩阵的维数,使得CW幅度谱矩阵降维后得到的编码矩阵维数较小,易于量化.此外,在甚低速率语音编码中,由于没有足够的比特数来描述编码参数,往往很难得到高质量的合成语音.本算法采用两帧联合编码、帧间后向预测三级矢量量化、离散余弦变换(DCT)和分裂式矩阵量化等技术来降低编码速率和改善音质.非正式主观听觉测试显示,1kb/s 2DNMF-WI编码器合成语音的质量稍差于2kb/s的NMF-WI语音编码算法.
- 薛二娟鲍长春李如玮
- 关键词:语音编码波形内插特征波形
- 基于小波变换的语音增强算法综述被引量:25
- 2009年
- 基于小波变换的语音增强方法是一种新颖的去噪方法,值得大家去研究利用。本文根据大量的文献资料,从小波分解、模极大值、小波系数相关性、阈值去噪及混合去噪法等几个方面,详细地介绍了目前国内外基于小波变换的语音增强方法的研究现状,分析了各种改进方法的优缺点,并论述了小波去噪的发展趋势,对提高语音信号处理的性能具有较大的应用价值。
- 李如玮鲍长春窦慧晶
- 关键词:语音增强小波变换噪声估计阈值去噪
- 基于NMF的语音特征波形矩阵量化方法
- 波形内插(Waveform Interpolation,WI)语音编码模型以其在窄带编码中的优越性能引起人们的广泛重视。本文基于特征波形的非负矩阵分解(Non-negative Matrix Factorization,...
- 刘靖宇鲍长春
- 关键词:语音编码特征波形非负矩阵分解
- 文献传递
- 基于贝叶斯阴阳机的2kb/s NMF-WI语音编码算法被引量:3
- 2009年
- 本文提出了一种改进型的基于非负矩阵分解(Nonnegative Matrix Factorization,NMF)的特征波形(Charac-teristic Waveform,CW)分解算法,一方面应用惩罚次胜者竞争学习算法(Rival Penalized Competitive Learning,RPCL)和贝叶斯阴阳机(Bayesian Ying-Yang,BYY)和谐学习算法,来计算NMF分解阶数,在没有明显降低语音质量的前提下,降低了编码器的复杂度;另一方面根据CW的能量与编码矩阵的能量间的变化关系,提出了相位谱的混合自回归合成方法,提高了语音的自然度.最后,开发出一套改进型2kb/s NMF-WI低复杂度语音编码方法,采用基于K-L散度的NMF迭代算法和收敛速度更快的基矢量Mel刻度分带初始化方法,按照基音周期的统计分布将特征波形分为6类,在CW分解模块,复杂度下降了10MOPS,语音质量提高,与采用4bit散布矢量量化相位谱的2.16kb/s NMF-WI语音编码器的语音质量相当.
- 郭莉莉鲍长春
- 关键词:语音编码波形内插特征波形非负矩阵分解
- 低速率WI编码器中4~6bit基音量化算法研究被引量:1
- 2007年
- 基音在语音编码中通常采用7bit无失真均匀量化。由于浊音段语音的基音普遍具有缓慢渐变的特点,为了更有效地去除前后帧基音之间存在的相关性,该文基于Eriksson和Kang提出的4bit基音量化算法,针对汉语语音进行研究,实现了一套4~6bit基音量化算法。该算法计算简单,无需码书存储。将此基音量化方案应用于WI模型和WI编码器,主观A/B听力测试结果表明,该方案在高效量化基音的同时保证了合成语音质量几乎没有损失,完全满足低速率WI编码器对量化基音的要求。
- 罗亚飞鲍长春
- 关键词:语音编码波形内插
- 一种用于WI语音编码的相位预测式矢量量化方法被引量:4
- 2007年
- 在传统的低比特率语音编码中,考虑到人耳对相位信息不敏感而经常忽略相位信息,这将导致语音粗糙、刺耳甚至音调发生改变。为了获得高质量的声码器,语音的相位信息是不能不考虑的。该文在散布相位矢量量化方法的基础上进一步去除了相位冗余,在波形内插(Waveform Interpolation,WI)编码模型中对相邻帧慢渐变波形(Slowly Evolving Waveform,SEW)的相位谱差值进行预测式矢量量化。实验发现,该方法大大改善了重建语音效果,明显提高了语音的自然度和清晰度。主观A/B测试结果显示,该方法与固定相位法相比,经4~6bit的相位量化可使合成语音质量得到显著的改善,相比散布相位矢量量化方法,女声的语音合成质量有所改进。
- 陈悦鲍长春
- 关键词:语音编码波形内插矢量量化