版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
1、第2章 音频处理(chl)技术(二)西安交通大学计算机教学实验中心(zhngxn)2007多媒体技术及应用基础QQ宝 共九十八页问题(wnt)的提出数字音频信息如何处理?用什么工具可以(ky)处理?有哪些处理?我能处理吗?2共九十八页二、数字音频数字音频原理(yunl)回顾3共九十八页声音(shngyn)的数字化 声音的数字化 数字化就是将连续信号变成离散信号。对音频信号,首先在时间上离散,取有限个时间点,称为采样。然后(rnhu)在幅度上离散,取有限个幅度值,称为量化。再将得到的数据表示成计算机容易识别的格式,称为编码。 4共九十八页声音(shngyn)的A/D与D/A转换模拟信号很容易受到
2、电子干扰,因此用数字信息代替声音信号成为音频信息处理的一种方法。A/D转换和D/A转换技术便应运而生。A表示Analog”(类比、模拟),D代表“Digital ”(数字(shz)),A/D转换就是把模拟电信号转换成由“0”和“1”组成数字(shz)信号的过程。这样做的好处是显而易见的,声音存储质量得到了加强,数字化的声音信息使计算机能够进行识别、处理和压缩,这也就是为什么如今磁带逐渐被淘汰,CD唱片却趋于流行的原因。A/D转换的一个关键步骤是声音的采样和量化,得到数字音频信号,它在时间上是不连续的离散信号。5共九十八页PCM编码(bin m)1939年法国工程师Alec Reeves发明了将
3、连续的模拟信号变换成时间和幅度都离散的二进制码代表的脉冲编码调制信号(Pulse Code Modulation-PCM),并申请了专利。P首先开始应用于电话系统,但一直到年美国(mi u)Bell实验室才为制成了国际上第一套商用电话系统(系统),这标志了通信开始步入数字化。PCM 编码是对连续语音信号进行空间采样、幅度值量化及用适当码字将其编码的总称。6共九十八页PCM编码主要(zhyo)优点 抗干扰能力强;失真(sh zhn)小;传输特性稳定,尤其是远距离信号再生中继时噪声不累积,而且可以采用压缩编码、纠错编码和保密编码等来提高系统的有效性、可靠性和保密性。 7共九十八页 A/D 和D/A
4、转换(zhunhun)示意图 8位可编程A/D转换(zhunhun)芯片示意图8共九十八页模拟声音(shngyn)信号的采样和量化过程示意 模拟声音信号的波形采样得到的离散时间信号再量化得到的数字信号9共九十八页数字音频的技术指标 采样(ci yn)频率采样精度声道数音频数据传输率编码算法与音频数据压缩比10共九十八页采样(ci yn)频率采样频率是指一秒钟采样的次数。采样频率越高,单位时间内采集的样本数越多,得到波形越接近于原始波形,音质就越好。 根据奈奎斯特(Harry Nyquist)采样理论(lln):如果采样频率高于输入信号最高频率的两倍,重放时就能从采样信号序列无失真地重构原始信号
5、。11共九十八页采样的3个常用(chn yn)频率分别为:11.025kHzAM(调幅)广播22.05kHz FM(调频)广播44.1kHz CD高保真音质声音现在声卡的采样频率一般(ybn)为48kHz甚至96kHz。 12共九十八页采样(ci yn)精度 采样精度(jn d)用每个声音样本的位数表示,也叫样本精度(jn d)或量化位数,反映度量声音波形幅度的精度(jn d)。例如,每个声音样本用16位表示,则量化样本值在065535之间,它的精度是输入信号的1/65536。 采样精度决定了模拟信号数字化以后的动态范围。采样精度影响到声音的质量位数越多,声音的质量越高,而需要的存储空间也越多
6、;位数越少,声音的质量越低,需要的存储空间越少。13共九十八页声道数 单声道(mono)信号一次产生(chnshng)一组声波数据。双声道或立体声(stereo)一次产生两组声波数据。双声道在硬件中占两条线路,一条是左声道,一条是右声道。立体声不仅音质、音色好,而且能产生逼真的空间感。但立体声数字化后所占空间比单声道多一倍。14共九十八页其他(qt)因素除采样频率、采样精度、声道数影响声音质量外,声音录制时环境噪声、声卡内部噪声以及采样数据丢失等都会造成声音质量的下降。实际(shj)收听时,音响(功率放大器、扬声器等)的质量对音质的表现也起很大作用。15共九十八页音频(ynpn)数据传输率 音
7、频信号数字化后,产生大量数据 。产生数据的速度或播放声音时需要传输(chun sh)数据的速度影响声音的播放质量。数据传输(chun sh)率用每秒钟传输(chun sh)的数据位数表示,记为bps(bit per second)。未经压缩的数字音频数据传输率为: 数据传输率(bits)=采样频率(Hz)量化位数(bit)声道数 16共九十八页声音(shngyn)质量和数字化指标 质量采样频率(kHz)样本精度(bit)单道声/立体声数据率(kB/s)(未压缩)频率范围电话*88单道声82003 400 HzAM11.0258单道声11.0507 000HzFM22.05016立体声88.22
8、015 000HzCD44.116立体声176.42020 000 HzDAT4816立体声192.02020 000 Hz17共九十八页 编码(bin m)算法与音频数据压缩比 未压缩的音频数据量非常大,因此在编码的时候常采用压缩的方式。实际上,编码的作用一是记录数字数据,二是采用一定的算法(sun f)来压缩数据以减少存储空间和提高传输效率。压缩编码的基本指标之一就是压缩比,一般为数据压缩前后的数据量之比:18共九十八页数据压缩(sh j y su)说明采用不同(b tn)的数字化指标实际上也是进行了不同(b tn)比例的数据压缩。如果PCM编码采用4bit量化对CD音质信号压缩,其压缩比
9、为4:1。压缩算法包括有损压缩和无损压缩;有损压缩解压后数据不能完全复原,要丢失一部分信息。无损压缩不丢失任何信息,能较好地复原原始信号。19共九十八页数字音频文件格式 数字声音(shngyn)文件格式是数字音频在磁盘文件中的存放形式,相同的数据可以有不同的文件格式,而不同的数据也可以有相同的文件格式。WAVE 格式MP3 格式RA 格式20共九十八页WAVE文件格式WAVE文件是一种通用(tngyng)的音频数据文件,文件扩展名为“WAV”,Windows系统和一般的音频卡都支持这种格式文件的生成、编辑和播放。CD激光唱盘中包含的就是WAVE格式的波形数据。一般说来,声音质量与其WAVE格式
10、的文件大小成正比。WAVE文件的特点是易于生成和编辑,但在保证一定音质的前提下压缩比不够,不适合在网络上播放。21共九十八页 MP3文件(wnjin)MP3文件是采用MP3算法压缩生成的数字音频数据文件,以“.MP3”为文件后缀。MP3利用MPEG制定的MPEG-1 Audio layer 3的压缩标准,将音频信息用10:1甚至12:1压缩率变成容量(rngling)较小的数据文件。虽然MP3是一种利用了人类心理声学特性的有损压缩,人耳基本不能分辨出失真,音质几乎达到了CD音质标准。按照这种算法,10张CD-DA的内容可以压缩到l张CD-ROM中,而且视听效果相当好。 22共九十八页 RA文件
11、(wnjin) Real Audio是Real networks推出的一种音乐压缩格式,它的压缩比可达到96:1,因此在网上比较流行。经过压缩的音乐文件可以在通过速率为14.4kb/s的MODEM上网的计算机中流畅回放。其最大特点是可以采用流媒体的方式实现网上实时(sh sh)播放,即边下载边播放。 23共九十八页五、多媒体数据的编码(bin m)技术 自然现象:我们了解的东西,描述它用的信息量少,不了解的东西,描述它用的信息量大。在信息(xnx)论中,可以说:信息(xnx)是用不确定的度量来定义的;一个消息的可能性越小,其信息(xnx)含量越大;消息的可能性越大,则信息(xnx)含量越小。2
12、4共九十八页(1)信息(xnx)和熵香农(C. E. Shannon)信息论应用概率来描述不确定性。事件出现的概率小,不确定性越多,信息量就大,反之则少。在数学上,所传输的消息是其出现概率的单调下降函数。所谓信息是指从N个相等可能事件中选出一个事件,所需要的信息度量或含量,也就是在辨识N个事件中某个特定事件过程中所需提问“是”或“否”的最少次数。如从64个数中选定某一个数,提问:“是否(sh fu)大于32?”,则不论回答是与否,都消去了半数的可能事件,如此下去,只要问6次这类问题,就可以从64个数中选定一个数。因此,可以用二进制的6个位来记录这一过程,就可以得到这条信息。25共九十八页信息源
13、x的熵 26共九十八页例2-10 27共九十八页例2-11 28共九十八页香侬理论(lln)的要点信源中含有自然冗余度,这些冗余度既来自于信源本身的相关性,又来自于信源概率分布的不均匀性,只要找到去除相关性或改变(gibin)概率分布不均匀性的手段和方法,也就找到了信息熵编码的方法。但信源所含有的平均信息量(熵)是进行无失真编码的理论的极限,只要不低于此极限,就能找到某种适宜的编码方法,去逼近信息熵,实现数据压缩。 29共九十八页(2)信息冗余 多媒体数据中大的数据量并不完全(wnqun)等于它们所携带的信息量。在信息论中,称为冗余。冗余是指信息存在的各种性质的多余度。减少数据冗余可以节省存储
14、空间,有效利用网络带宽。 30共九十八页数据冗余(rn y)的类型空间(kngjin)冗余 物理特性具有相关性。 时间冗余 相邻帧图像之间有较大的相关性。 信息熵冗余 自然编码的比特分配不能达到最佳。视觉冗余 人眼不能察觉图像中的所有变化。知识冗余 数据的理解与先验知识有很大的关系。例如,当接收到一个成语的前三个字“大惊小”时,就知道下一个字肯定是“怪”。听觉冗余 人耳不能察觉所有频率的变化。31共九十八页数据压缩(sh j y su)的基本原理数据压缩的对象是数据。数据是信息的载体,用来记录和传送信息。真正有用的不是数据本身,而是数据所携带的信息。大的数据量并不代表含有大的信息量 。而对于去
15、掉冗余(rn y)的数据对信息没有本质的影响称为压缩。32共九十八页(3)压缩算法的分类(fn li) 从信息量有无损失划分:可逆编码和不可逆编码。可逆编码也叫无失真编码、冗余度压缩、熵编码等。其原理是减少数据中的冗余度,而不损失任何信息。解压时可以完全恢复出原来的数据,亦称无损压缩。典型的无损压缩有Huffman编码、算术编码和行程编码等。可逆编码由于不会产生失真,因此在多媒体技术中常用于文本、数据的压缩,它能保证完全地恢复原始数据。但这种方法的压缩比较(bjio)低,一般在2:15:1之间。33共九十八页不可逆编码(bin m)不可逆编码是有失真压缩,信息论中叫熵压缩。由于压缩了熵,会减少
16、信息而不能再恢复。因此这种压缩又称有损压缩。在语音和图像中,由于存在视觉冗余和听觉冗余,减少这种信息并不影响人们的听觉效果和视觉效果,所以经常采用这种方法,有损压缩常用于数字化存储的模拟(mn)数据,并且主要应用于图像、声音、动态视频等数据的压缩。如果用混合编码的JPEG标准,对自然景物的彩色图像,压缩比可达到几十倍甚至上百倍。34共九十八页压缩算法分类(fn li)根据压缩原理划分(hu fn)有预测编码、变换编码、矢量编码、子带编码、熵编码等。 35共九十八页1)预测(yc)编码 对于(duy)语音,就是通过预测去除语音信号时间上的相关性。而对于(duy)图像,帧内预测去除了空间上的冗余,
17、帧间预测则可以去除时间上冗余。目前大多数语音、图像编码中都采用了预测技术。例如语音中的LPC(linear Predictive Coding,线性预测)、CELP(码激励线性预测)、图像中的ADPCM(自适应差分脉冲编码调制)等。36共九十八页2)变换编码变换编码首先把要压缩的数据变换到某个变换域中,然后再进行编码。变换域中表现为能量(nngling)集中在某些区域,就可以利用这一特点在不同区域间有效地分配量化比特数,或者去掉这些能量(nngling)很小的区域,从而达到数据压缩的目的。例如声音中的频谱分析实际上是对语音波形进行了快速傅里叶变换(FFT),将时域信号变到了频域中,可以清楚地看
18、到能量集中在哪些频率范围内。 37共九十八页3)矢量(shling)量化矢量量化是利用相邻数据(shj)间的相关性,将数据(shj)序列分组进行量化的一种压缩方法。和预测编码一样,矢量量化本质也是利用数据(shj)序列的统计相关性进行压缩的。38共九十八页4)子带编码(bin m)子带编码首先让原始数据分别通过若干个具有不同通频带的滤波器,将信号(xnho)分成多个子带信号(xnho)输出,然后分别对各个滤波器的输出进行编码。当滤波器选取得合适时,它们的输出将各自具有不同的分布特性,对各频段进行不同的量化处理,可以有效地进行数据压缩。 39共九十八页5)熵编码(bin m)根据(gnj)信息墒
19、的原理,用短码表示出现概率大的数据,用长码表示出现概率小的数据。这是一种无损数据压缩技术,在语音和图像编码中常常和其它有损压缩编码方法结合使用。 40共九十八页2.基本(jbn)压缩编码方法 哈夫曼(Huffman)编码在1952年为文本文件而建立。霍夫曼编码的码长是变化的,对于出现频率(pnl)高的信息,编码的长度较短;而对于出现频率(pnl)低的信息,编码长度较长。这样,处理全部信息的总码长一定小于实际信息的符号长度。41共九十八页例2-12设信号源为X= 、a、e、I、m、t、c、h、r。对应的概率为p=O.22、0.22、0.14、O.07、0.07、0.07、0.07、0.07、0.
20、07,试给出该信源的霍夫曼编码方案。若传送一个串字符串“I am a teacher”,共14个字符。若用ASCII传送,每个字符8位,共需112位。该字符串中有9个不同的符号,至少需要4位二进制才能表示,这样(zhyng)传送该字符串也要56位。若用刚计算的Huffman编码,只需要42位。 42共九十八页霍夫曼编码(bin m)过程 43共九十八页(2)行程编码(bin m)原理 由字符(或信号采样值)构成的数据流中相同的字符(或字符串)会连续重复出现,重复出现的字符长度称为游程长度RL(Run Length)。如果给出了形成串的字符,串的长度及串的位置,就能复出原来的数据流。行程编码RL
21、C(Run Length Coding)就是(jish)用二进制码字给出上述信息的一类方法。行程编码又称“运行长度编码”或“游程编码” 44共九十八页例2-13设有数据流“AAABBBBCCCCCDAAAAAA”,试计算该数据的行程编码。解:A重复3次,B重复4次,C重复5次,D不重复,A重复6次,RLC数据流为:“SA3SB4SC5DSA6”,其中S为指示(zhsh)符。总共占用13个字节,而源数据占用19个字节。有时行程编码不用指示符,重复与否相同对待,则相应的RLC为“A3B4C5D1A6”占用10个字节。45共九十八页3.数字音频压缩(y su)标准 1.电话质量的语音压缩(y su)
22、标准 。标准编号要 点G.711采用PCM编码,采样频率8kHz,采样精度8bit,数据率64kb/s,非线性量化G.721基于ADPCM编码,采样频率8kHz,数值差分用4位量化,数据率32kb/sG.723ADPCM编码,数据率24k/sG.728LD-CELP编码技术,数据率16k/s,音质与G.721相当电视会议的语音编码、为提高线路利用率的多媒体多路复用装置、数字录音电活的数字记录部件以及高质量的语音合成器;数字移动通信、无绳电话。ITU 国际电信联盟 International Telecommunication Union46共九十八页(2)调幅广播(gungb)质量的音频压缩标
23、准调幅广播质量音频(ynpn)信号的频率范围是50Hz7kHz,又称“7kHz音频(ynpn)信号”,当使用16kHz的采样频率和14bit的量化位数时,信号速率为224kbs。1988年ITU制定了G.722标准,它可把信号速率压缩成64kbs。G.722标准基于子带ADPCM技术(SBADPCM),将现有的带宽分成两个独立的子带信道,使输入信号进入滤波器组分成高子带信号和低子带信号,然后分别进行ADPCM编码,最后进入混合器形成输出码流。这种压缩方法能够在每秒8kB的存储量下给出相当好的音乐信号,也很适合于需要存储大量高质量音频信号的多媒体系统使用。 47共九十八页(3)高保真立体声音频压
24、缩(y su)标准 高保真立体声音频信号的频率范围50Hz20kHz,在44.1 kHz采样(ci yn)频率下用16bit量化,信号速率为每声道1410kbs。目前国际上比较成熟的高保真立体声音频压缩标准为MPEG音频。MPEG Audio是一个子带编码系统,声音数据压缩算法的根据是心理声学模型。心理声学模型中一个最基本的概念是听觉系统中存在一个听觉阈值电平,低于这个电平的声音信号就听不到。听觉阈值的大小随声音频率的改变而改变,各个人的听觉阈值也不同。大多数人的听觉系统对2kHz5kHz之间的声音最敏感。一个人是否能听到声音取决于声音的频率,以及声音的幅度是否高于这种频率下的听觉阈值。48共
25、九十八页MPEGMPEG声音(ISO/IEC 11172-3)压缩算法是世界上第一个高保真声音数据压缩国际标准,并且得到了极其广泛的应用。MPEG声音标准是MPEG标准的一部分,但它也完全可以独立应用。MPEG声音标准提供(tgng)三个独立的压缩层次:层1(Layer 1)、层2(Layer 2)和层3(Layer 3),用户对层次的选择可在复杂性和声音质量之间进行权衡。 49共九十八页四、数字音频处理(chl) 本节介绍数字音频的应用(yngyng)技术,包括声音的采集、编辑以及音效处理。 编辑工具:Windows下的录音机Sound ForgeGoldWave50共九十八页 1、基本操作
26、 通过下例学习文件的打开、声道的转换、数字化指标的转换、提高音量和文件格式转换 例2.4 example_0220.wav文件是一个(y )双声道立体声语音文件,采样频率44.1kHz,采样精度32位,请对其做以下处理:将双声道声音转换成单声道声音;采样频率转换为8kHz,样本精度转换成16位;将其音量提高20%;将文件格式转换为mp3格式,话音质量。51共九十八页操作步骤 打开文件。使用“FileOpen”命令打开声音文件example_0220.wav 声道转换。执行“ProcessChannel Converter”命令 修改技术指标。执行“processResample”命令,输入新的
27、采样频率“8,000”; 设置位深。执行“ProcessBit-depth Converter”命令,在打开的对话框中设置“Bit depth”为“16”位。 提高音量(ynling)。执行“ProcessVolume”菜单命令 保存文件为mp3文件。执行“FileSave As”命令,保存类型选择“MP3 Audio(*.mp3)”,单击“Template”右边的“Custom”按钮,打开“Custom Setting”(自定义设置),选择“Bit Rate”为“8kbps 8,000Hz”,单击“OK”,并保存文件。52共九十八页 2、声音的录制(l zh)与格式转换 在使用计算机进行录音
28、时,话筒的插头应插入声卡的MIC(话筒)输入插座内。声卡有两个输入插座,一个用于话筒,一个用于线路输入。用于话筒的插座灵敏度高,一般为O.53mv,适于输入微弱的信号;用于线路输入的插座灵敏度低,主要与音响设备的线路输出端连接,适于输入强度较大的信号,一般为5001000mv。上述两个插座不要(byo)混淆。如果把话筒插在线路输入插座内,将录不到声音 。53共九十八页(1)质量(zhling)选择录制声音时应根据不同的要求选择不同的质量参数,包括采样频率、样本位数、声道数、编码格式等。录音时,应注意调整输入信号的强度,使其不超过录音设备的动态范围,否则将产生削顶失真,音感阻塞,严重时无法辨别声
29、音的内容。信号强度过低,也不能获得满意的声音,原因是信号与噪声的比值小,噪声相对(xingdu)比较明显,影响了音质。正式录音前,最好先试录一次,以调整音响效果。 54共九十八页(2)声音(shngyn)格式的转换 一般的声音处理软件兼容多种格式的声音文件(wnjin),使得声音格式的转换非常简单,只要在保存文件(wnjin)时使用“另存为”,然后选择不同的文件(wnjin)格式、质量级别、压缩算法或不同的性能指标。例2.5 以22.1kHz的采样频率、16位位深度录制以下唐诗。去除录制过程中过长的停顿、喀喀声,调整音量,分别将其保存为WAV文件、FM音质的MP3文件和rm文件。55共九十八页
30、3、朗读(lngd)并录音为人进出的门紧锁着 为狗爬出的洞敞开着 一个声音高叫着“爬出来吧,给你自由(zyu)” 我,渴望自由 但我深深地知道:人的身躯怎能从狗洞里爬出 我希望有一天 地下的烈火将我和这口活棺材一起烧掉 我,愿在烈火中永生!56共九十八页录音(l yn)操作步骤环境准备启动(qdng)Sound Forge创建新文件选择音频格式参数录音按指定文件格式保存57共九十八页环境(hunjng)准备连接话筒,在Windows控制面板中双击“声音和多媒体”图标,打开“声音和多媒体”对话框(图2-19a),选择“音频(ynpn)”选项卡,单击“录音”选框中的“音量”按钮,打开“Record
31、ing Control”(录音控制)对话框。如果使用话筒录音,则在“Microphone”下的小方框中打“”,音量滑块调到90%左右。58共九十八页启动(qdng)Sound Forge 59共九十八页创建(chungjin)新文件选择(xunz)“File”“New”,创建一个新文件。60共九十八页选择格式(g shi)参数选择(xunz)采样频率选择位深度选择声道数61共九十八页录音(l yn) 单击工具栏中录音(l yn)按钮,打开“Recording”对话框,单击“录音(l yn)”按钮 。62共九十八页编辑(binj)调整在编辑窗口中没有波形的区域是没有声音(shngyn)的区域。不
32、做任何选择,执行“ProcessVolume”菜单命令调整整体音量的大小,也可选择某个区域调整音量。63共九十八页保存(bocn)文件执行“FileSave As”保存声音文件。保存WAV文件选择文件类型“Wave(Microsoft)(*.wav)”;保存MP3 文件选择文件类型 “MP3 Audio(*.mp3)”,模板选择“64kbps,FM Radio Quality Audio”;保存RM文件选择文件类型“RealMedia(*.rm)”,模板选择“56kbps Audio”,适合使用56k MODEM以上线路上网(shn wn)的用户,也可选其他模板。保存的3个文件的大小分别为54
33、5kB、101kB和56kB,时间长度为12秒。64共九十八页 4、声音(shngyn)的剪辑 声音文件可以进行剪辑操作:删除就是去掉声音文件中的一段数据。两段数据排列顺序的不同就改变(gibin)了声音播放的先后顺序。将两个文件中的声音数据连接起来保存在一个文件中就实现了声音的连接。当然也可以将原来的声音文件分成两个声音文件存放,就实现了声音的分割。 65共九十八页剪辑(jinj)操作步骤 确定编辑区域;选定起点(Mark In)和终点(Mark Out) 声音编辑,编辑操作可以使用“Edit”菜单中的命令,也可以使用与Word相同(xin tn)快捷键。 去除噪声;去除噪声使用“Effec
34、tNoise Gate”菜单命令。 静音处理, “Process Mute” 例2.6 笨狼上学 66共九十八页 5、声音的效果(xiogu)处理 淡入淡出频率均衡控制混响合唱效果声音的混合(hnh)声道摇动67共九十八页(1)淡入淡出“淡入(Fade In)”和“淡出(Fade Out)”指声音的渐强和渐弱,通常用于声音的开始、结束,两个声音素材的交替切换(qi hun),产生渐近渐远的音响效果等场合。淡入效果使声音从无到有、由弱到强。而淡出效果则正好相反,声音逐渐消失。淡入与淡出的过渡时间长度由编辑区域的宽窄决定。淡入淡出常用于节目的开始、结尾和两段声音之间的过渡,使声音的出现和消失不太突
35、然。68共九十八页实现(shxin)方法在SoundForge中选择一段声音,执行(zhxng): “ProcessFadeIn”(淡入) “ProcessFadeOut”(淡出)产生淡入或淡出效果,也可以使用:“ProcessFadeGraphics”命令在打开的对话框中拖动增益曲线随意地编辑淡入和淡出效果。69共九十八页淡入淡出效果声音(shngyn)波形 淡入淡出声音(shngyn)70共九十八页(2)频率均衡(jnhng)控制频率均衡(EQ)控制指对声音素材的低音区、中音区、高音区各个频段进行(jnxng)提升和衰减等控制,使声音的层次和频段分布更符合要求。这一技术从根本上改变了音频文
36、件的固有频率均衡值。 频率均衡使用“ProcessEQ”命令71共九十八页均衡(jnhng)效果示意图 源音滤掉部分低频(dpn)的均衡效果均衡控制指对不同频段的声音音量的调整,可以使声音产生清脆、低沉、柔和等效果。72共九十八页(3)混响(hn xin) 声音在传播过程中遇到障碍物,会产生反射、绕射及散射。因此形成直达声、反射次数较少的早期反射声和多次反射形成的混响声。混响是乐器或话音及从物体表面反射回来的声音的混合(hnh),用软件模拟混响的原理是将滞后一段的声音提前加到原声音上播放。混响时间的长短可以改变音色,混响时间短,声音干涩;混响时间长,声音圆润,具有空旷感。 73共九十八页数字(
37、shz)混响的基本原理把指定编辑区域内的声音滞后一小段时间再叠加到原来的声音上。影响混响效果的参数(cnsh)是叠加声音的音量和滞后时间长度。根据延迟信号的延迟时间和幅度的不同,可以调制出任何大小房间、音乐厅、礼堂、教堂、山谷等环境的音响效果。混响时间短,声音干涩,声音就像在近前发出的一般;混响时间长,声音圆润,具有空旷感。 命令:EffectsReverb 74共九十八页混响(hn xin)效果混响(hn xin)源音混响效果75共九十八页(4)合唱(hchng)效果 合唱效果可以把一个人的声音变成两个的声音,把两个人的声音变成4个人等,从而产生合唱效果或把小乐队的演奏(ynzu)变成大乐队
38、的合奏效果 影响合唱效果的参数主要有三个:合唱程度(Chorus Size)、调制速率(Modulation Rate)和合唱输出(Chorus Out)。它们的值越大,效果越明显。命令:EffectsChorus 76共九十八页(5)声音(shngyn)的混合 声音混合将两段声音混合在一起,可以为自己的歌曲或语音配上音乐(ynyu)。将两段声音混和在一起,首先要保证两段声音的采样频率相同。为保证质量,应将低的采样频率改为高的采样频率。 命令序列:ProcessResample EditCopy EditPaste SpecialMix(注) 77共九十八页声道摇动(yo dng)可以让声音(
39、shngyn)交替地从左右声道上发出,产生声的立体效果,称为摇动(Pan,平底锅)。命令:ProcessPan78共九十八页摇动(yo dng)编辑对话框79共九十八页添加摇动效果的声音(shngyn)波形摇动(yo dng)效果80共九十八页5.声音(shngyn)的频谱分析 频谱分析(Spectrum Analysis)是分析数字音频频率分布情况的强有利(yul)工具,使用它可以很清楚地看到所处理的声音文件中各种频率的声音的分布情况。 命令: ToolsSpectrum Analysis 该声音频率范围在20-3.3kHz内,量化只要8kHz的采样频率即可。81共九十八页作业(zuy)第2
40、章2,5,7,11实验(shyn)制作音频作品82共九十八页Huffman(哈夫曼)编码(bin m)Huffman树的定义(dngy)构造Huffman树Huffman编码Huffman编码的译码83共九十八页Huffman树的定义(dngy)Huffman树也称为最优树,是一类带权路径(ljng)最短的二叉树。树的带权路径长度定义为: WPL = wklkk = 1n 其中: n 是树中叶结点的个数 wi 是第i个结点的权值 li 是第i个结点的路径长度84共九十八页Huffman树举例(j l)以下(yxi)有三棵树:(a)(b)(c)abcdabcdacbd777555222444WP
41、La =7x2+5x2+2x2+4x2 = 36WPLb =7x3+5x3+2x1+4x2 = 46 WPLc = 7x1+5x2+2x3+4x3 = 35 事实证明按哈夫曼树构造二叉树,可得到很好的特性,应用于实际问题,可提高处理效率。85共九十八页应用(yngyng)举例由统计规律(gul)可知,考试成绩的分布符合正态分布:-1 1 0 分数 059 60 69 70 79 80 89 90 100比例数 0.05 0.15 0.40 0.3 0.10 根据正态分布规律,在6090之间的分数占85%,而不及格和优秀是少数。86共九十八页将百分制转换成五分制判定(pndng)树比较:a60?
42、a70?a80?a90?不及格 及格(j g) 中等 良好 优秀YYYYNNNNa80?a70?a90?a60?不及格 优秀 良好 中等 中等 及格不及格YYYNNNNYY(A)(B)若输入1万个数据,按A的判定过程进行操作,约需比较3.2万次,而按B比较,则仅需2.2万次。87共九十八页构造(guzo)Huffman树构造Huffman树算法步骤:Step1 将n个带权值wi(in)的结点构成n棵二叉树的集合T=T1,T2,Tn,每棵二叉树只有一个根结点。Step2 在T中选取两个权值最小的结点作为左右子树,构成一个新的二叉树,其根结点的权值取左右子树权值之和;Step3 在T中删除这两棵树,将新构成的树加入到T中;Step4 重复(chngf)2)、3)步的操作,直到T中只含一棵树为止,该树就是Huffman树。88共九十八页构造(guzo)Huffman树举例以权值分别为7,5,2,4的结点(ji din)a、b、c、d构造Huffman树。T= a b c d cdT3246bT3T26511bT26511cd2418aT2711T1618a7T1bT3T251118a7T1b511cd264(d)T= T1 (c)T= a T
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 老旧小区供热提升可行性研究报告
- 建设工程目标控制方案
- 某造纸厂节能环保细则
- 给排水管道施工方案
- 房建工程质量验收管理制度
- 药品电子追溯扫码及数据上传操作手册
- 直播选品功效验证规范手册
- 2026年危险化学品安全作业考前冲刺练习题附答案详解
- 配送企业安全管理员定期维护安全操作规程
- 住宅楼装修施工方案
- 体态康复模板
- T/CAPE 11005-2023光伏电站光伏组件清洗技术规范
- 肿瘤破溃伤口处理
- 公司承包给个人经营合同
- 输尿管成形术后护理
- 伴生放射性矿开发利用企业环境辐射监测要求、监测年度报告格式与内容
- 受灾群众集中转移安置方案及受灾群众基本生活保障方案
- 中国证监会证券市场交易结算资金监控系统证券公司接口规范
- 实验室试剂管理培训
- 院前创伤的急救处理
- 2.2.6车辆辅助系统维护与操作-照明系统操作
评论
0/150
提交评论