第三章 分析化学中的误差与数据处理_第1页
第三章 分析化学中的误差与数据处理_第2页
第三章 分析化学中的误差与数据处理_第3页
第三章 分析化学中的误差与数据处理_第4页
第三章 分析化学中的误差与数据处理_第5页
已阅读5页,还剩118页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

第3章分析化学中的误差及数据处理3.1分析化学中的误差3.2有效数字及其运算规则3.3少量数据的统计处理3.4显著性检验3.5可疑值取舍3.6回归分析法3.7提高分析结果准确度的方法1.准确度和精密度绝对误差:测量值与真值之间的差值,用E表示E=x-xT3.1分析化学中的误差准确度:测定结果与真值接近的程度,用误差衡量。误差相对误差:绝对误差占真值的百分比,用Er表示Er=E/xT=(x-xT)/xT×100%真值:某一物理量本身具有的客观存在的真实数值。真值客观存在,但绝对真值不可测。理论真值:某一化合物的理论组成约定真值:长度、质量、时间、电流强度、热力学温度、发光强度、物质的量,各元素的相对原子质量、化合物的分子量。相对真值:精密度高一个数量级的测定值作为低一个数量级的测量值的真值。标准参考物质的证书上给出的含量。标准参考物质:指某些具有确定含量的组分,在实际样品定量测定中用作计算被测组分含量的直接或间接的参照标准的一类物质。

经公认的权威机构鉴定并给予证书的具有很好的均匀性和稳定性含量测量的准确度至少高于实际测量3倍例1:用分析天平称量两物体的质量各为1.6380g和0.1637g,假定两者的真实质量分别为1.6381g和0.1638g,求两者称量的绝对误差和相对误差。解:两者称量的绝对误差分别为

两者称量的相对误差分别为结论:相对误差更能体现误差的大小,绝对误差相同的数据,相对误差可能不同。相对误差考虑了分析结果自身的大小,表示准确度更有实际意义。因此,在分析工作中,用相对误差来表示各种情况下测定结果的准确度更为确切。例2:滴定分析中滴定剂体积的控制50mL滴定管的精度?常量滴定分析时,通常要求滴定管读数引起的误差在±0.1%以内,同时要求节约试剂,因此滴定体积一般应控制在20-30mL范围内(25mL)。读取一次滴定体积的绝对误差?计算滴定体积分别为2.00.和20.00时相对误差。±0.01mL±0.02mL解:例3:滴定分析中称样质量的控制万分之一分析天平的精度?常量滴定分析时,通常要求称量引起的误差在±0.1%以内,因此称样质量一般一般应控制在0.2000g以上。称取一份试样的绝对误差?计算称样质量分别为20.0和200.0mg时相对误差。±0.1mg±0.2mg解:偏差:

测量值与平均值的差值,用d表示di=xi-X精密度:平行测定结果相互靠近的程度,用偏差衡量。∑di=01)绝对偏差:个别测量值与平均值之间的差值,用d表示。各单次测定的偏差相加,其和为零。2)相对偏差:绝对偏差与平均值的比值。3)平均偏差:各单个偏差绝对值的平均值4)相对平均偏差:平均偏差与测量平均值的比值说明:平均偏差不计正负号.缺点:小偏差的测定总是占多数,大偏差的测定总是占少数,按总的测定次数去求平均偏差所得的结果偏小,大偏差得不到充分的反映。例4:有两组测定值甲组:2.92.93.03.13.1乙组:2.83.03.03.03.2解:甲组:平均值=3.0平均偏差=0.08乙组:平均值=3.0平均偏差=0.08平均偏差5)标准偏差:又称均方根偏差,当测定次数趋于无限多时,称为总体标准偏差,用σ

表示。◆用标准偏差衡量数据精密度好坏的好处:①标准偏差不必考虑偏差的正负号;②大偏差能更显著地反映出来,故能更好地反映数据的精密度。注:一般情况下,测定次数是有限的,这时的标准偏差称为样本标准偏差,以s表示。◆结论:用统计方法处理数据时,广泛采用标准偏差来衡量数据的分散程度。

样本标准偏差:s

相对标准偏差:RSD注:①对于一组n个测量数据的样本,其偏差的自由度为f=n-1;自由度:指独立变数的个数,指在n次测量中,只有n-1个可变的偏差,用

f表示。②在样本标准偏差中引入(n-1)的目的,主要是为了校正代替µ所引起的误差。很明显,当测量次数非常多时,n与n-1的区别就很小。

例4:有两组测定值甲组:2.92.93.03.13.1乙组:2.83.03.03.03.2解:甲组:平均值=3.0平均偏差=0.08标准偏差=0.08乙组:平均值=3.0平均偏差=0.08标准偏差=0.14平均偏差与标准偏差的关系6)极差或全距(R):一组测量数据中,最大值与最小值之差。可见:标准偏差通过平方运算,能将较大的偏差更显著地表示出来。因此能更好地反映测定值的精密度。特点:简单直观,便于运算;没有利用全部测量数据。准确度与精密度的关系1.精密度高,准确度不一定高;可能有系统误差存在;2.精密度低,测定结果一定不可靠;3.准确度高一定要求精密度高,即精密度是保证准确度高的前提;4.当系统误差消除后,可用精密度表示准确度。准确度及精密度都高-结果可靠准确度与精密度的关系练习题:1、下面论述中正确的是:A.精密度高,准确度一定高B.准确度高,一定要求精密度高C.精密度高,系统误差一定小D.分析中,首先要求准确度,其次才是精密度答案:B2、某人对试样测定五次,求得各次测定值的偏差d分别为+0.04,-0.02,+0.01,-0.01,+0.06。则此计算结果应是A.正确的B.不正确的C.全部结果是正值D.全部结果是负值=0答案:B

设一组测量数据为x1,x2,x3,…算术平均值x2系统误差与随机误差①系统误差:又称可测误差,它是由于分析过程中某些经常发生的比较固定的原因所造成的。

特点:重复性、单向性,可测性(又叫可测误差)。对分析结果的影响恒定,可以测定和校正,在同一条件下,重复出现;影响准确度,不影响精密度;可以消除。分类:根据产生的具体原因可分为

1)方法误差——选择的方法不够完善2)试剂误差——所用试剂有杂质

例:重量分析中沉淀的溶解损失,滴定分析中化学计量点与滴定终点不一致

例:去离子水不合格;试剂纯度不够3)仪器误差——仪器本身的缺陷例:天平两臂不等,砝码未校正;滴定管,容量瓶未校正4)主观误差——操作人员主观因素造成例:对指示剂颜色辨别偏深或偏浅;滴定管读数不准5)操作误差:

由于分析的操作不够正确所引起的误差为操作误差。例:

对沉淀的洗涤次数过少或过多;灼烧沉淀时温度过高或过低。②随机误差(偶然误差):由某些难以控制且无法避免的偶然因素造成的。例:滴定管读数的不确定性、称量时温度及湿度的波动、仪器性能的微小变化等。

特点:大小及正负不定,不可避免,无法测量和校正;服从正态分布规律。

产生的原因:偶然因素(室温,气压的微小变化);个人辩别能力(滴定管读数)。③过失误差

由粗心大意引起,可以避免的如:错用样品、选错仪器、加错试剂、器皿不清洁、试样损失或沾污、操作不规范、忽视仪器故障、读数错误、记录和计算错误等。性质:是错误,而不是误差。错误的处理:确知操作错误测得的数据必须舍弃。一旦出现过失,应立即停止,及时纠正,重做实验。④误差的减免系统误差的减免

(1)方法误差——

采用标准方法,对照实验,回收试验

(2)仪器误差——

校正仪器

(3)试剂误差——

作空白实验偶然误差的减免

——增加平行测定的次数

系统误差与随机误差的比较项目系统误差随机误差产生原因固定的因素不定的因素分类方法误差、仪器与试剂误差、主观误差性质重现性、单向性(或周期性)、可测性服从概率统计规律、不可测性影响准确度精密度消除或减小的方法校正增加平行测定的次数①系统误差

a.加减法R=A+B-C

3误差的传递R=A+B-C

ER=EA+EB-EC若R=mA+nB-pC

ER=mEA+nEB-pEC分析结果的绝对系统误差等于各测量值绝对系统误差的代数和。

b.乘除法

结论:分析结果的相对系统误差是各测量值相对系统误差的代数和。c.指数运算

结论:分析结果的相对系统误差是测量值相对系统误差的指数倍。d.对数运算②随机误差

a.加减法若R=mA+nB-pC

sR2=m2sA2+n2sB2+p2sC2R=A+B-C结论:分析结果的样本标准偏差的平方是各测量值标准偏差的平方的总和。

b.乘除法

R=mA×nB/pC

sR2/R2=sA2/A2+sB2/B2+sC2/C2结论:分析结果的相对标准偏差的平方是各测量值相对标准偏差的平方的总和。c.指数运算或d.对数运算③极值误差:就是考虑在最不利的情况下,各种误差都是最大的,而且互相叠加。a.加减法:R=A+B-C

│ER│max=│EA│+│EB│+│EC│结论:在加减运算中,分析结果可能的极值误差是各测量值绝对误差的绝对值加和。b.乘除法结论:在乘除运算中,分析结果的极值相对误差是各测量值相对绝对误差的绝对值加和。

3.2有效数字及运算规则

一.有效数字位数:包括全部可靠数字和一位不确定数字。在有效数字中,只有最后一位数是不确定的,可疑的。有效数字的位数由仪器的准确度决定,它直接影响测定的相对误差。定义:即分析工作中实际能够测到的数字。23.45ml23.44ml23.46ml准确可疑(欠准)数字有效数字=准确数字+末位可疑(欠准)数字(估读数,末位±1误差)1.0008431815位0.100010.98%4位0.03821.98

10-103位540.00402位0.052

1051位3600100不确定

有效数字位数的判断0~91~9:有效数字0:双重意义在1~9之前:非有效数字,只作定位用在1~9之间或之后:有效数字确认有效数字应遵循的原则

1.在0~9中,只有0既是有效数字,又是无效数字0.05030g非有效数字,定位有效数字四位有效数字数值试样质量0.3500g0.35g试液体积25.00ml25ml有效数字四位两位四位两位所用仪器分析天平台秤移液管或滴定管量筒(杯)2.进行单位变换的时候,有效数字的位数应保持不变。3.对于很小或很大的数,用0定位不方便时,可改用指数形式表示(即科学计数法),但应注意有效数字位数不变。10.00ml0.1000L15.0g15000mg1.50×104mg0.05030g5.030×10-2g3.pH及pKa等对数值,其有效数字的位数仅取决于小数部分数字的位数。

4.首位为8或9的数字,有效数字可多计一位。pH=11.02[H+]=9.6×10-12mol/L两位有效数字5.自然数和常数可看成具有无限多位数(如倍数、分数关系)

6.误差和偏差只需保留1~2位m

分析天平(称至0.1mg):12.8228g(6), 0.2348g(4),0.0600g(3)

千分之一天平(称至0.001g):0.235g(3)

1%天平(称至0.01g):4.03g(3),0.23g(2)

台秤(称至0.1g):4.0g(2),0.2g(1)V

☆滴定管(量至0.01mL):26.32mL(4),3.97mL(3)

☆容量瓶:100.0mL(4),250.0mL(4)

☆移液管:25.00mL(4);

☆量筒(量至1mL或0.1mL):25mL(2),4.0mL(2)二.有效数字运算中的修约规则尾数≤4时舍;尾数≥6时入尾数=5时,若后面数为0,舍5成双;若5后面还有不是0的任何数皆入四舍六入五成双例下列值修约为四位有效数字

0.32474 0.32475 0.32476 0.32485 0.324851

0.32470.32480.32480.32480.3249禁止分次修约运算时可多保留一位有效数字进行0.57490.570.5750.58×■加减法运算

计算结果的绝对误差不小于各项中绝对误差最大的数据0.53620.0010.25+0.78720.540.000.25+0.79修约修约两位小数,

最大3运算规则(与小数点后位数最少的数一致)5.21×0.2000×1.0432=1.08701441.09修约三位有效数字,ER%最大■乘除法:结果的相对误差应与各因数中相对误差最大的数相适应(与有效数字位数最少的一致)

分析化学数据记录及结果计算的基本规则

⑴记录测定结果:正确保留有效数字位数,且只应在最末位保留一位可疑数字;⑵进行数字修约:先根据运算法则确定有效数字位数后,按数字修约规则进行修约,再计算结果。若使用计算器,可不进行修约,但应注意正确保留最后计算结果的有效数字位数;①不同含量组分:高含量组分(>10%)——4位中含量组分(1~10%)——3位微量组分(<1%)——2位②不同分析方法:化学分析——4位仪器分析——2~3位③误差、偏差:2位④自然数:不考虑有效数字位数问题平衡离子浓度保留二或三位有效数字标准溶液浓度保留四位有效数字分析化学计算中报出分析结果的基本原则3.3有限数据的统计处理总体样本数据统计方法例3:矿石中铁含量的分析,取样、过筛、混匀、缩分后,得500g.总体:500g试样;若随机抽8份试样,得8个分析结果,则构成一个随机样本,n=8;再随机抽6份试样,得6个分析结果,则又构成一个随机样本,n=6.总体平均值:当数据无限多时将无限多次测定的平均值称为总体平均值,用符号μ表示。真值xT:在确认消除系统误差的前提下总体平均值就是真值。总体:考察对象的全体.

样本:从总体中随机抽取的一组测量值.

样本容量:样本所含的测量值的数目(n).

样本平均值:

x随机现象与随机事件:基本条件不变,重复试验或观察,会得到不同的结果,称随机现象;随机现象中的某种结果(如测量值)称为随机事件(随机变量)。频率(frequency):

如果n次测量中随机事件A出现了nA次,则称F(A)=nA/n。概率(probability):随机事件A的概率P(A)表示事件A发生的可能性大小.一.标准偏差1.总体标准偏差σ无限次测量2.样本标准偏差s样本均值n→∞时,→μ,s→σ3.相对标准偏差(变异系数RSD)x5.总体标准偏差与总体平均偏差的关系

δ=0.7979σ

≈0.80σ4.总体平均偏差(无限次测量)偏差总体样本绝对偏差平均偏差标准偏差总结设有一样品,m

个分析工作者对其进行分析,每人测n

次,计算出各自的平均值,这些平均值的分布也是符合正态分布的。试样总体样本1样本2……样本m平均值的总体标准偏差:对有限次测量:6.平均值的标准偏差平均值的总体标准偏差平均值的样本标准偏差单次测量值的总体标准偏差单次测量值的样本标准偏差对有限次测量:1、增加测量次数可以提高精密度。2、增加(过多)测量次数的代价不一定能从减小误差得到补偿,一般3~4次就可以了,要求较高可达5-9次

。结论:测量次数3.3随机误差的正态分布在相同条件下对某样品中铁的质量分数(%)进行重复测定,得到100个测定值如下:系统误差:可校正消除随机误差:不可测量,无法避免,可用统计方法研究一.频数分布1.361.491.431.411.371.401.321.421.471.391.411.361.401.341.421.421.451.351.421.391.441.421.391.421.421.301.341.421.371.361.371.341.371.461.441.451.321.481.401.451.391.461.391.531.361.481.401.391.381.401.461.451.501.431.451.431.411.481.391.451.371.461.391.451.311.411.441.441.421.471.351.361.391.401.381.351.421.431.421.421.421.401.411.371.461.361.371.27*1.471.381.421.341.431.421.411.411.441.481.55*1.37

1.分组:视样本容量的大小将所有数据分成若干组:容量大时分为10-20组,容量小时(n<50)分为5-7组,本例分为9组。2.排序:3.找最大值和最小值4.算极差R。R=1.55%-1.27%=0.28%5.确定组距=极差与组数之比。组距=

R/9=0.28%/9=0.03%。每组内两个数据相差0.03%。即:1.26-1.29,1.29-1.32等等。为了使每一个数据只能进入某一组内,将组界值较测定值多取一位。

1.265-1.295,1.295-1.325,1.325-1.355等

频数:测定值落在每组内的个数相对频数:数据出现在各组内的频率组距相对频数结论:位于中间数值1.36-1.44之间的数据多一些,在其他范围的数据少一些,小至1.27或大于1.55附近的数据更少一些。特点:离散特性:测定值是分散、波动的,但测定值在平均值周围波动。波动的程度用总体标准偏差

表示。集中趋势:所有数据有向某个值集中的趋势。m:总体平均值算术平均值二、正态分布--高斯曲线

对于频数分布图,如果测定次数不断增加,组距越来越小,分组越来越多时,频数分布的形状将逐渐趋向于一条曲线。

n→∞相对频数分布直方图正态分布曲线图mm记作N(μ,σ2)x1、数学表达式

f(x):

测量值的概率密度函数;

x:

测量值,从该分布抽出的随机样本值;

:总体平均值;

:

正态分布的标准偏差;

x-

:单次测量值的随机误差;由图可看到随机误差有以下规律性:1)小误差出现的概率大,大误差出现的概率小;特别大的误差出现的概率极小。2)正误差出现的概率与负误差出现的概率相等。3)x=

时,y值最大,体现了测量值的集中趋势。集中的程度与有关。总体标准偏差相同,总体平均值不同总体平均值

相同,总体标准偏差

不同原因:1、总体不同2、同一总体,存在系统误差原因:同一总体,精密度不同①不管µ、σ为何值,分布曲线和横坐标之间所夹的面积,就是概率密度函数在-∞<x<+∞区间的积分值,它代表各种大小偏差的测定值出现概率的总合,其值为1。结论:②测定值落在区间(a,b)的概率P(a≤x≤b)等于横坐标上x=a,x=b区间的曲线和横坐标之间所夹的面积,即

三.标准正态分布:将正态分布的横坐标改为u表示又dx=σdu所以,即u称为标准正态变量。N(0,1)经过上述变换,总体平均值为μ的任一正态分布均可化为μ=0,σ2=1的标准正态分布,以N(0,1)表示。标准正态分布曲线如右图所示,曲线的形状与μ和σ的大小无关。①标准正态分布曲线与横坐标-∞到+∞之间所夹的总面积,它表示来自同一总体的全部测定值或随机误差在上述区间出现概率的总和为100%,即为1。结论:②随机误差在某一区间出现概率(即:测量值在某一区间内出现概率),可以取不同u值进行积分。③正态分布概率积分表就是这样制出来的,表3-2是从0~u进行积分。随机误差的区间概率概率P为:取不同u值积分,得分布概率积分表随机误差出现的区间u(以为单位)测量值出现的区间概率%(-1,+1)(-1,+1)68.3(-1.96,+1.96)(-1.96,+1.96)95.0(-2,+2)(-2,+2)95.5(-2.58,2.58)(-2.58,+2.58)99.0(-3,+3)(-3,+3)99.768.3%95.5%99.7%00.10.20.40.5f(u)-3

0+1

+2

+3

-1

-2

u解(1)找u值:查表:u=1.5时,概率为:20.4332=0.866=86.6%(2)查表:u>2.5时,概率为:0.5–0.4938=0.0062=0.62%例1:已知某试样中Co的标准值为1.75%,测得

=0.10%,又知测量时无系统误差,求结果落在(1)1.75

0.15%概率;(2)测量值大于2%的概率。曲线下面积|u|s2s0.6740.25001.0000.34130.6831.6450.45001.9600.47500.9502.0000.47732.5760.49870.9903.0000.49870.997∞0.5001.000正态分布概率积分表正态分布表-2-1012y0.30.20.10-2-1012y0.30.20.10双边检验表中值

21-表中值

2单边检验表中值0.5-表中值计算步骤:

X、μ、σu1、u2u1u2注意:表中查出的P为单边的值。查正态分布概率积分表查正态分布概率积分表正态分布是无限次测量数据的分布规律,而在实际工作中,只能对随机抽得的样本进行有限次的测量。对于有限测定次数,总体标准偏差σ是不知道,只好用样本标准偏差s来代替,这样必然引起正态分布曲线的偏差。y-3-2-10123-0.4-0.3-0.2-0.12有限次测量数据的统计处理有限测量数据:随机误差符合t分布,即用t代替正态分布u,样本标准偏差s代替总体标准偏差σt分布曲线可衍生出:t分布纵坐标仍然表示概率密度值,横坐标则用统计量t值来表示。结论:◆对于正态分布,u值一定,响应概率就一定;◆t分布曲线随自由度f

而改变,t一定,f不同,面积不同,概率不同;◆当f趋近∞时,t分布就趋近正态分布;当f=20时,实际上t值与u值已十分接近了。

◆t分布下面一定区间内的积分面积,就是该区间内随机误差出现的概率。

置信度与显著性水平置信度P:某一t值时,测定值x出现在μ±ts范围内的概率。显著性水准α:测定值x出现在μ±ts范围之外的概率,α=1-P。t值与f有关,也与不同范围内概率值(置信度P)有关,不同置信度P与f值所对应的t值,可用tα,f

表示。如t0.05,10

代表置信度95%,自由度为10时的t值。½

½

-t

(f)

t

(f)

yP置信度

用单次测量结果x来估计总体平均值µ的范围:平均值的置信区间μ=x±1σ

μ=x±2σμ=x±3σ当用单次测量结果x

来估计总体平均值μ

的范围,则置信区间:在预先选定的置信度下,按照统计学的方法由有限次数据估算出包括真值在内的区间。若以样本平均值来估计总体平均值可能存在的区间,则对于少量测量数据,则用t

分布处理(1)该式常作为分析结果的表达式。(2)置信区间的宽窄与置信度、测定值的精密度和测定次数有关,当测定值精密度↑(s值小),测定次数愈多(n↑)时,置信区间↓,即平均值愈接近真值,平均值愈可靠。(3)上式的意义:在一定置信度下(如95%),真值(总体平均值)将在测定平均值附近的一个区间即在之间存在,把握程度95%。

该式常作为分析结果的表达式。(4)置信度↑,置信区间↑,其区间包括真值的可能性↑,一般将置信度定为95%或90%。对于有限次测量:x

,n,s,总体均值μ

的置信区间为:总结:置信度越高,置信区间越大。例:对某未知试样中Cl-的百分含量进行测定,4次结果为47.64%,47.69%,47.52%,47.55%,计算置信度为90%,95%和99%时的总体平均值μ

的置信区间.解:(1)P变大,置信区间变宽,包括真值的可能性大;但P=100%,则意味着区间无限大,肯定会包括,这样的区间毫无意义;(2)分析中常定置信度为95%或90%;结论:(3)对平均值置信区间的解释:是说当测定n次时,有一定的把握说总体平均值包含在置信区间的范围里。

定量分析数据的评价--解决两类问题:(1

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论