第七章矢量量化_第1页
第七章矢量量化_第2页
第七章矢量量化_第3页
第七章矢量量化_第4页
第七章矢量量化_第5页
已阅读5页,还剩38页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

1、概述 矢量量化的基本原理 失真测度 最佳矢量量化器和码本设计 降低复杂度的矢量量化系统 语音参数的矢量量化,第七章 矢量量化,7.1 概述,矢量量化(VQ,即Vector Quantization)是一种极其重要的信号压缩方法。VQ在语音信号处理中占十分重要的地位。广泛应用于语音编码、语音识别和语音合成等领域。 量化分为两类: * 标量量化:将取样后的信号值逐个地进行量化。 * 矢量量化:将若干取样信号分成一组,即构成一个矢量,然后对此矢量一次进行量化。 凡是要用量化的地方都可以采用矢量量化。,矢量量化是实现数据压缩的一种有效方法,早在50和60年代就被用于语音压缩编码。直到70年代线性预测技

2、术被引入语音编码后,矢量量化技术才活跃起来。80年代初,矢量量化技术的理论和应用研究得到迅速发展。,7.2 矢量量化的基本原理,标量量化是对信号的单个样本或参数的幅度进行量化;标量是指被量化的变量,为一维变量。 矢量量化的过程是将语音信号波形的K个样点的每一帧,或有K个参数的每一参数帧构成K维空间的一个矢量,然后对这个矢量进行量化。,矢量量化的定义,将信号序列 的每K个连续样点分成一组,形成K维欧式空间中的一个矢量,矢量量化就是把这个K维输入矢量X映射成另一个K维量化矢量。其中量化矢量构成的集合 称为码书或码本,码书中的每个矢量 称为码字或者码矢。,以K2进行说明: 当K2时,所得到的是二维矢

3、量。所有可能的二维矢量就形成了一个平面。 记为(a1,a2),所有可能的(a1,a2) 就是一个二维空间。如图7-1所示,图7-1 矢量量化概念示意图,矢量量化就是将这个平面划分为M块S1,S2,SiSM,然后从每一块中找出代表值Yi(i1,2.M),这就构成一个有M个区间的二维矢量量化器。图(b)所示的是一个7区间的二维矢量量化器,即K2,M7。 通常这些代表值Yi称为量化矢量。 所有M个量化矢量构成的集合 Yi 称为码书或码本; 把码书中的每个量化矢量Yi(i1,2.M)称为码字或码矢。,量化方法: 对一个矢量X进行量化,首先选择一个合适的失真测度,然后用最小失真原理,分别计算用量化矢量Y

4、i替代X所带来的失真。 其中最小失真值所对应的那个量化矢量,就是矢量X的重构矢量(或恢复矢量)。,存在的问题 一、如何划分M个区域边界。 方法是:将大量欲处理的信号的矢量进行统计划分,进一步确定这些划分边界的中心矢量值来得到码书。 二、如何确定两矢量在进行比较时的测度。 这个测度就是两矢量间的距离,或以其中某一矢量为基准时的失真度。它描述了当输入矢量用码书所对应的矢量来表征时所应付出的代价。,图7-2 矢量量化系统的组成,工作过程: 在编码端,输入矢量Xi与码书中的每一个码字进行比较,分别计算出它们的失真。搜索到失真最小的码字 的序号 (或该码字所在码书中的地址),这些序号就作为传输或存储的参

5、数。 在恢复时,根据此序号从恢复端的码书中找出相应的码字 。由于两本码书完全相同,此时失真最小,所以 就是输入矢量Xi的重构矢量。,特点: 传输存储的不是矢量本身而是其序号,所以 据有高保密性能;用于传输时,其传输速率可以进一步降低; 收发两端没有反馈回路,因此比较稳定; 矢量量化器的关键是编码器的设计,译码器 只是简单的的查表过程。,矢量量化的性能指标除了码书的大小M以外还有由于量化而产生的平均信噪比: 矢量量化的准则:在给定码本大小K时使量化所造成的失真最小。,7.3 失真测度,前面我们讲过设计矢量量化器的关键是编码器的设计。而在编码的过程中,就需要引入失真测度的概念。,失真测度:是将输入

6、矢量Xi用码本重构矢量Yi来表征时所产生的误差或失真的度量方法,它可以描述两个或多个模型矢量间的相似程度。,失真度选择必须具备的特性: 必须在主观评价上有意义,即小的失真应该对应于好的主观语音质量; 必须是易于处理的,即在数学上易于实现,这样可以用于实际的矢量量化器的设计; 平均失真存在并且可以计算; 易于硬件实现。,常见失真测度方法,均方误差失真测度(即欧氏距离) 加权的均方误差失真测度 板仓斋藤(ItakuraSaito)似然比距离 似然比失真测度 等等,一、欧氏距离均方误差 设输入信号的某个K维矢量X,与码书中某个K维矢量Y进行比较,xi,yi分别表示X和Y中的各元素 ,则定义均方误差为

7、欧氏距离:,几种其他常用的欧氏距离:,r方平均误差,2. r平均误差,3.绝对值平均误差,4.最大平均误差,二、线性预测失真测度,用全极模型表示的线性预测方法,广泛应用于语音信号处理中。它在分析时得到的是模型的预测系数。仅由预测系数的差值,不能完全表征这两个语音信息的差别。应该直接由这些系数所描述的信号模型的功率谱来进行比较。,当预测器的阶数 ,信号与模型完全匹配时,信号功率谱为:,信号的功率谱,预测误差能量,预测逆滤波器的频率响应,相应的,设码书中某重构矢量的功率谱为,则定义Itakura-Saito距离为,这种失真测度是针对线性预测模型、用最大似然准则推导出来,所以特别适用于LPC参数描述

8、语音信号的情况,常用于LPC编码中。我们由此又推导出两种线性预测失真测度,它们比上述具有更好的性能,即,对数似然比失真测度,模型失真测度,注:这两种失真测度都仅仅比较两矢量的功率谱,而没有考虑其能量信息。,三、识别失真测度,失真测度的定义,加权因子,输入信号矢量的归一化能量,码书重构矢量的归一化能量,当两矢量的能量接近时(即 ),忽略能量差异引起的影响;当两矢量能量相差很大时,即进行线性加权;而当能量差超过门限 时,则为固定值,7.4 最佳矢量量化器和码本的设计,最佳设计就是使失真最小,最佳设计中,重要的问题是如何划分量化区间和确定量化矢量。这两个条件回答了两个问题:,(1)、最佳划分,(2)

9、、最佳码书,一、矢量量化器最佳设计的两个条件,最佳矢量量化器满足的两个必要条件,1)Voronoi分割条件(最近邻准则),对信号空间的分割应满足,2)Centroid质心条件,子空间分割固定后,Voronoi胞元的质心就是量化器的码字,对于一般的失真测度和信源分布,很难找到质心的计算方法,但对于一般的分布和常用的均方失真测度,可以证明,是 中包含的矢量个数,二、LBG算法,1980年由Linde,Buzo和Gray提出,它是标量量化器中Lloyd算法的推广,在矢量量化中是一个基本算法。,LBG算法由于其理论上的严密性、应用上的简便性以及较好的设计效果,得到了广泛的应用,并常被作为各种改进算法的

10、基础。,LBG算法是一种递推算法,从一个事先选定的初始码本中开始进行迭代,直到系统满足性能要求或不再有明显改进为止。,LBG算法步骤,第一步:初始化,给出训练VQ码书所需的全部参考矢量X,X的集合用S表示;设定量化级数,失真控制门限 ,算法最大迭代次数L以及初始码书 ;设总失真 ;迭代次数的初始化为m1,第二步:迭代,2)计算失真:,1)根据最近邻准则将S分成N个子集 , , , 即当 时,下式成 立:,4)计算相对失真改进量 :,3)计算新码字,将 与失真门限值 进行比较。若 则转入 6)否则转入5);,5)若 则转至6),否则m加1,转至1),第三步:结束,6)得到最终的训练码书 ,,并输

11、出总失真,为了避免迭代算法无限制循环下去,这里设置了两个阈值参数:最大迭代次数L和失真控制门限 。 的值设得远小于1,当 时,表明再进行迭代运算失真的减小是有限的、可,以停止运算。L是限制迭代次数的参数,防止 设置较低时迭代次数过多,三、初始码书的选择,随机选取法,分裂法 乘积码书法,7.5 降低复杂度的矢量量化系统,矢量量化系统主要由编码器和译码器组成: 编码器主要由码书搜索算法和码书构成, 译码器由查表方法和码书构成。 矢量量化器的研究主要围绕降低速率(运算量)、减少失真和降低复杂度(存储量)展开。 降低复杂度的设计方法大致分为两类: 一类是无记忆的矢量量化器, 另一类是有记忆的矢量量化器

12、。,一、无记忆的矢量量化系统,无记忆矢量量化是指量化每一个矢量时都不依赖于此矢量前面的其他矢量,即每一个矢量都是独立量化的。,1、全搜索矢量量化器,前面我们介绍的LBG算法,在进行VQ编码时,采用的就是全搜索法,即对于每个输入矢量,比较它与每一个码书中的码字的失真,并将失真最小的码字标号作为输出,2. 树形搜索的矢量量化系统,树形搜索是减少矢量量化计算量的一种重要方法。,它又分为二叉树和多叉树两种:,码字不象普通的码字那样随意放置,而是排列在一棵树的接点上,如图所示,码本尺寸为M=8的二叉树,它的码本中共包含14个码字。输入矢量X先与Y0和Y1比较,计算出失真d(X,Y0)和d(X,Y1)。如

13、果后者较小,则走下面支路,同时送出“1”,同理,如果最后达到Y101,则送出的输出角标101。这就是矢量量化的过程。,表71 二叉树与全搜索的比较,二叉树搜索的主要优点是计算量有很大减少而性能下降并不多,但存储量增加。,2. 多级矢量量化系统,多级矢量量化器由若干级矢量量化器级联而成,因而又称级联矢量量化器。 多级矢量量化不仅可以减少计算量还可以减少存储量。 多级矢量量化器由若干个小码书构成。,图7-5 两级矢量量化系统工作框图及码书训练,先采用一个小的码书,其长度为M1,用它来逼近输入信号矢量;然后再用第二个小码书,其长度为M2,用它来对第一次的误差进行编码;输入矢量与第一级匹配,得到其地址编号i,然后在第二级码书中搜索与这个误差矢量最佳匹配的矢量,得到其地址编号j,将 和 同时发送出去,在接受端根据 和 来恢复原来的矢量,由于每本码书的体积较小,所以采用全搜索法,二、有记忆的矢量量化系统,在量化每一个输入时,不仅与此矢量本身有关,而且也与前面的矢量有关 。,有记忆矢量量化系统,反馈矢量量化,自适应矢量量化,分类:,预测矢量量化PVQ (Predictive VQ),有限状态矢量量化 FSVQ(Finite-State VQ),自适应矢量量化

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论