某地区电力负荷数据分析与预测_第1页
某地区电力负荷数据分析与预测_第2页
某地区电力负荷数据分析与预测_第3页
某地区电力负荷数据分析与预测_第4页
某地区电力负荷数据分析与预测_第5页
已阅读5页,还剩22页未读 继续免费阅读

付费下载

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

某地区电力负荷数据分

析与预测

本页仅作为文档封面,使用时可以删除

Thisdocumentisfbrreferenceonly-rar21year.March

(封面格式)

报名序号:1249

论文题目:某地区电力负荷数据分析与预测

姓名班级有效联系电话

参赛队员1陈富安全工程

参赛队员2谢海燕统计学

参赛队员3王浩统计学

指导教师:唐玲

参赛学校:安徽建筑大学南区

证书邮寄地址、邮编、收件人:

地址:安徽合肥市经开区紫云•路292号安徽建筑大学南区邮政编码:

230061

收件人姓名:陈富联系电话:

报名序号:1249

论文题目:某地区电力负荷数据分析与预测

阅卷专家1阅卷专家2阅卷专家3

论文等级

某地区电力负荷数据分析与预测

摘要

针对两个地区历史数据分析及未来数据相关预测,本文用统计学相关理论

为基础对两个地区历史数据进行探索分析,深入并直观的描述了数据的分布情

况;同时利用时间序列乘积季节模型和LMBP神经网络模型分别对未来数据进

行预测并进行相关误差分析•,分别得到不同预测方法下的预测结果。

对于问题一,本文对两个地区2014年1月1日一2014年12月31日的负荷

数据进行挖掘分析,选取描述数据集中趋势的均值和中位数统计量、描述数据

分布离散程度的方差和离散系数统计量以及描述数据分布偏态与峰度的偏度系

数和峰度系数统计量来描述各地区全年的日最高负荷、日最低负荷、日峰谷

差、日负荷率指标的分布情况;绘制出了两地区2014年全年负荷持续曲线;结

合上述结果,分析出地区2负荷变化数据波动较平缓,初步预判地区2的负荷

可以获得更准确的预测结果。

对于问题二,本文根据2012年1月1日至2014年12月31日的数据,用

偏最小二乘法,分别末日最高负荷、日最低负荷、日平均负荷与各气象因素关

系进行回归分析,得出6个多元线性回归模型,同时得到各个回归模型的离差

平方和,以离差平方和的大小来反映回归误差的大小;使用简单相关系数检验

法,通过各个气象因素相互之间的相关系数矩阵,得出最高温度、最低温度、

平均温度这三个因素相关系数较高,存在多重共线性;再经过变量的显著性检

验,得出若要用气象因素来提高负荷预测精度,优先推荐平均温度、降雨量、

湿度这三个气象因素的结论。

对于问题三,考虑到历史电力负荷数据具有明显的周期性,建立时间序列

乘积季节模型,对两个地区2015年1月11日至17日共7天的电力负荷进行预

测,得出负荷预测结果见附件。由于模型中各个参数均通过了参数的显著性检

验,残差序列通过了残差检验为白噪声序列,体现了模型对原序列的信息提取

十分充分,所以在不知道实际负荷数据的情况下,有充分理由判断预测结果的

准确度是较高的。

对于问题四,考虑最日高温度等5个天气因素,利用包含5个输入层,7个

隐含层和一个输出层的LMBP神经网络预测模型在5个天气因素影响下,再次

对两个地区2015年1月11日至17日共7天的电力负荷进行预测,得出负荷预

测结果见附件。

对于问题五,综合上述结果参数,并同时引用股票分析中的黄金分割线对

两个地区负荷数据规律优劣进行评价。得出地区2的数据规律性优于地区1的

结论。

关键词:描述性统计,偏最小二乘回归,时间序列乘积季节模型,LMBP

§1问题的提出

一、背景知识

短期负荷预测是电力系统运行与分析的基础,对机组组合、经济调度、安

全校核等具有重要意义。提高负荷预测精度,是保障电力系统优化决策科学性

的重要手段。现代电力系统中,构成电力负荷的用电器种类繁多,空调等受气

象条件影响的负荷占比持续增高,气象因素(温度、湿度、降雨量等)对电力

系统负荷的影响愈显突出。考虑气象因素成为调度中心进一步改进负荷预测精

度的主要手段之一。

二、相关试验数据

已知地区1、地区2从2009年1月1日至2015年1月10日的电力负荷数

据(每15min一个采样点,每日96点,量纲为MW)以及2012年1月1至

2015年1月17日的气象因素数据(日最高温度、日最低温度、日平均温度、

日相对湿度以及日降雨量),详见附件1-数据.xlsx。

三、要解决的问题

1.请分析两个地区2014年1月1日-2014年12月31日的负荷数据,统计各

地区全年的日最高负荷、日最低负荷、日峰谷差、日负荷率指标的分布情况,

并绘制两地区2014年全年的负荷持续曲线;结合上述结果,分析两地区负荷变

化的主要差异;初步预判哪个地区的负荷可以获得更准确的预测结果,说明你

的理由O

2.根据2012年1月1日至2014年12月31日的数据,分别对日最高负荷、

日最低负荷、日平均负荷与各气象因素的关系进行回归分析,分析回归误差;

如果要用气象因素来提高负荷预测精度,在诸气象因素中,你优先推荐哪个

(或哪几个)简要说明理由。

3.请根据已知负荷数据,构建预测方法,对两个地区2015年1月11日至

17日共7天的电力负荷进行预测(间隔15min),给出负荷预测结果(提交两

个地区96*7负荷预测结果数据,具体要求见附录1);在不知道实际负荷数据

的条件下,你对预测结果的准确度有何推断,请说明理由。

4.如果已获得2015年1月11日至17日的气象因素数据,你能否构建计及

气象因素的负荷预测方法,对两个地区2015年1月11日至17日共7天的电力

负荷再次进行预测(间隔15min),给出预测结果(提交两个地区96*7负荷预

测结果数据,具体要求见附录1);与原有的预测结果相比,你认为计及气象

因素影响的负荷预测结果精度得到改善了吗有何证据请说明理由。

5.综合上述计算结果,你如何评价两地区负荷规律性的优劣你还有什么证

据可以佐证两地区负荷整体规律性优劣的判断

§2问题的分析

1)对于问题一,本文使用统计学方法,并利用MATLAB对所给数据进行

处理,分别绘制出日最高负荷、日最低负荷、日峰谷差、日负荷率四个指标

分别随时间变化的曲线图,并且分别得出数据的集中趋势、数据分布离散程

度和数据的分布偏态与峰度3个大方面来描述统计分布情况.

2)对于问题二,本文对日最高负荷、日最低负荷、日平均负荷与各气象因

素的关系进行偏最小二乘多元回归分析,在EVIEWS软件中分别得出两个

地区6个线性回归方程,并同时对线性回归方程误差进行了分析。

3)对于问题三,要求由己知负荷数据对两个地区2015年1月11日至17日

共7天的电力负荷进行预测。相对于已知数据来说,预测属于短期预测.故

本文利用时间序列季节乘积模型对这7天数据进行预测。

4)对于问题四,要求利用2015年1月11日至17日的气象因素数据构建计

及气象因素的负荷预测方法,同样的对两个地区2()15年1月11日至17日

共7天的电力负荷再次进行预测。本文在MATLAB中利用LMBP算法进行

7天电力负荷再次预测。

5)对于问题五,要求综合上述计算结果,比较两地区负荷数据的优劣。本

文通过选取上述计算结果日峰谷差方差等几项具有代表性的参数来对两地区

数据规律性进行综合评价,并结合股票中黄金分割线思想来进一步佐证评价

结果。

§3模型假设

1)假设所有数据来源真实可靠;;

2)假设电负荷量只受题目所给五项气象因素影响

3)在建立乘积季节模型,序列周期选取时,假设一年都是365天;

§4名词解释与符号说明

一、名词解释

1)日最高负荷:典型日中记录的负荷中,数值最大的一个;

2)日最低负荷:典型日中记录的负荷中,数值最小的一个;

3)日峰谷差:日最高负荷与最低负荷之差;

4)日负荷率:日平均负荷与日最大负荷的比值;

5)年持续负荷曲线:按一年中系统负荷的数值大小及其持续小时数顺序绘

制的曲线;

6)离散系数:一组数据标准差与其均值的比,也称为标准差系数,是测度

数据离散程度的相对指标;

7)偏度系数:是描述分布偏离对称性程度的一个特征数。当分布左右而称

时,偏度系数为0。当偏度系数大于。时,即重尾在右侧时,该分布为右

偏。当偏度系数小于0时,即重尾在左侧时,该分布左偏。

8)峰度系数:峰度是用来反映频数分布曲线顶端尖峭或扁平程度的指标。

有时两组数据的算术平均数、标准差和偏态系数都相同,但他们分布曲线顶

端的高耸程度却不同。

二、符号说明

序号符号含义

1X、Y解释变量、被解释变量

2八名解释变量的第一主成分

3勺%表示解释变量矩阵X中第j个变量的第/个样本值

4x表示被解释变量矩阵丫中第i个样本值

5局芯表示%标准化后的数值,

6Xy;表示尤标准化后的数值

7Eo.Fo标准化矩阵

8表示),关于七的回归系数

Pi

9)表示原变量的为与今之间的相关系数

10J表示误差对权值微分的雅克比矩阵

§5模型的建立与求解

一、问题一的分析与求解

根据上文中对日最高负荷、日最低负荷、日峰谷差以及日负荷率的相关描

述,再由附件中所提供的两个地区2014年1月1日-2014年12月31日的负荷

数据,利用MATLAB软件绘制出了两个地区全年的日最高负荷、日最低负

荷、日峰谷差、日负荷率四个指标分别随时间变化的折线图,如图1(相关程

序见附录一)。

两烟区日最as负荷比枝两地区日最低负荷比较

图1两个地区各指标对比图

根据统计学⑴中常用来描述数据特征,再结合本题所给数据特点,本文选

取了数据的集中趋势(均值、中位数)、数据分布离散程度(方差、离散系

数)和数据的分布偏态与峰度(偏度系数、峰度系数)三个大方面中六个参数

对两个地区2014年1月1日-2014年12月31日的全年的日最高负荷、日最低

负荷、日峰谷差、口负荷率四个指标数据进行进一步描述。利用SPSS软件求

出数据的六个参数,如表1所示。

表1两个地区相关数据分布表

集中趋势分布离散程度分布偏态与峰度

散系

偏度系

峰度

区1

奇2

区1

区2

区1

区2

区1

区2

根据卜文中对全年的负荷持续性曲线的相关,再由附件中所提供的两个地

区2014年1月1日-2014年12月31日的负荷数据,利用MATLAB软件绘制出

了两个地区全年的负荷持续性曲线图(相关程序见附录一),如图2所示。

图2全年持续性曲线

由图1可知:在全年的日最高负荷、日最低负荷、日峰谷差、日负荷率四

个指标中地区2数值高于地区1的数值,说明地区2的总体用电量大于地区1

的用电量。由表1可知:地区2统计平均数大于地区1,同样证明地区2总体用

电量较大,再对比方差等其他参数,地区2的数据波动范围相对较小,数据的

分布较为集中,且较为对称。由图2同样可知,地区2的用电量在几乎全年各

时刻均高于地区1的用电量。

在大量数据的前提下做预测分析,数据变化范围越小,预测结果越准确。

由上述分析可知,地区2的数据更加平稳,波动范围小,所以在后续负荷预测

中,地区2相对于地区1可以获得更为准确的结果。

二、问题二的分析与求解

偏最小二乘法回归分析原理

偏最小二乘回归分析⑵是多元线性回归分析、典型相关分析及主成分分析

有机结合。在主成分分析基础理论中,从被解释量x和解释变量丫中提取的第

1主成分八和/应尽量多地携带原始数据的变异信息,时所提取的成分方差达到

最大,则有

£)(0-max,。(〃|)fmax(1)

式中。乜)、0(%)表示〈和%的方差。

在典型相关分析中,为保证解释量与被解释量之间的相关性,在典型成分

4和/的提取过程中,应使典型成分之间的相关性关系最大,则有

r(t[必)-max(2)

式中小必)表示乙和外的相关系数。

这样,在x和丫中提取的成分不和对不仅能够最大程度上地携带x和y的

基本信息,而且保值了乙和%具有比较强大的解释能力。提取第1个主成分%

后,实施x和y对乙的回归分析,如果精度满足要求,则不再计算;否则,提

取残余信息继续进行回归分析,直到满足要求为土。如果最终对x共提取,〃个

成分乙、G、L、则丫对x回归分析即可以转化为丫对;、力、L、tm

的一组多元回归分析,而自变量X主成分4、、L、均可由X线性表示,

所以最后可还原成丫对x的回归方程。

具体建模求解

根据解释量个数不同,偏最小二乘回归分析可分为单变量偏最小二乘同归

分析和多变量偏最小二乘回归分析。根据题目要求,本文分别对口最高负荷、

日最低负荷和日平均负荷三个被解释变量进行多变量偏最小二乘回归分析。

I)设已知被解释变量日最高负荷丁和5个解释变量内(最高温度)、了2

(最低温度)、平均温度)、无4(相对湿度)和天(降雨量),样本数为

〃(〃二1096),形成解释变量矩阵X=hx2七x4/1096K5和被解释矩阵

y=[ylo将X与y进行标准化处理,得到标准化后的解释变量矩阵a和被

解释变量矩阵产0。做标准化处理是为了公式表达的方便和减少预算误差。

—3/1096x5

/o=(yj)1096x1

z=l,2,L,k;j=\,2,3,4,5

式中:/表示解释变量矩阵Y中第7个变量的第,个样本值:l表示解释变量

x中第/个变量个弓均值,力表示为的标准差,切表示被解释变量矩阵y中第i

个样本值,亍表示被解释变量y的均值,S、.

表示被解释变量》的标准差,考表示%.标准化后的数值,y;表示上标准化后的

数值。

2)从E。中提取第1主成分乙=£。叫,其中⑷/为a的第1主轴,即

||^||=1,及和见均是标准化矩阵,则有

班1

“=彳=।=M

忸司IJg/a")_y⑷

―。喝二口1

身”

pa,y)&+r(x2,y)%+•••+「(/,),)扇](5)

式中:Eoi(z=L2,L,k)表示Eo的第,列,r(x1,y)(z=l,2,L,k)表示看

与y的相关系数。在简化算法中只需求出瓦对外的回归系数8即可,无需实施

用对乙的回归。

Eo=hP;+E1(6)

二E0八

lk.ll2

式中:PI表示及对内的回归系数,臼表示回归方程残差矩阵

E[=E°fP](8)

3)重复建模步骤2),以上取代瓦,以B取代F。,用同样的方法得到

r

帅=丹FF、;由于不再是标准化矩阵,所以有

M闻I

cov(gj,),)

里]M(9)

2

片%||^cov(xpy)[cov(£“y)

j=i

fi=E。"(10)

(11)

E2=(12)

式中cov(£|j,y)表示E1.与y的协方差。

依次类推,从第4)步开始,可用交叉有效性来确定偏最小二乘回归分析

中成分提取个数,并停止迭代。

在得到成分4、4、L、r/n(m<AfA=rank(X))))后,然后再实施娟关

于4、L、L、〃的回归分析,即为

庶=格+弘+…*”(13)

由于乙(九二1,2,L,m)均为a的线性组合,所以有

h-l

4=Bi叼=&)n(/一吗P;)叫=E°w;(14)

;=|

0一1

记卬;="(/一吗耳)/,其中/为单位矩阵,所以综合可得:

■=[£>;+.•〃*=/(▽;+・・・■―)(15)

若记£=£<()“'=1),%.=工〃%(/=1,2,乙,后),则标准化变量)」关丁¥的

h=l

回归方程为

y=a}\+a2x^+L+akxk(16)

最后,通过标准化的逆过程,可得到y关于吃的回归方程为

y=Px\^P2x2+L+pkxk(17)

式中0卜=12L,k)表示y关于%的回归系数。

5)分别改变对应被解释变量,重复以上步骤,分别对日最高负荷、日最低

负荷和日平均负荷三个被解释变量进行回归分析。利用EVIEWS进行求解(具

体结果见附录二),整理后结果如表2所示。

表2线性回归曲线表

t也区1t也区2

日最高y=5583.5-39.095+12().77々+X=4006.41+19.18升+26.32%+

负荷

120.85X-12.72X+5.8

34150.40X3-I9.69X4+2.95X5

日最低.2二2869.84—20.74%+82.93%+)S=4159.76-7.2x+27.43月+

负荷

65.67&-8.56%+3.92为176.27^-23.69x4+11.04.r5

日平均

%=4382.51-29.43%+101.%+y3=4083.63-16.64&+18.48马+

负荷

91.76X3-10.85X,+4.33/194.7%-20.78国+9.3年

气象因素选择

下面进行气象因素的选取:

首先由EVIEWS分析,得到五个气象因素相互之间的相关系数,汇成关系

数表,如下所示:

表3地区一各气象因素相关系数表

XIX2X3X4X5

XI1

X21

X31

X41

X51

表4地区二各气象因素相关系数表

XIX2X3X4X5

XI1

X21

X31

X41

X51

从两个地区气象因素相关系数表可以看出公々用两两之间相关系数较大,

均接近与1,根据综合判别法与简单相关系数检验法分析的结果可以知道,本

案例的最高温度、最低温度、平均温度这三个回归变量间确实存在多重共线

性,变量蕴含的信息相互交叉影响,没有必要将这三个变量全部引进模型,可

以经过分析对其中个别变量进行剔除⑶。

接下来,构造,统计量,进行变量的显著性检验。

在变量的显著性检验中,针对变量不('=L2,3,4,5)设计的原假设与备择假

给定一个显著性水平a,得到临界值〃于是可根据-2-1)来

32

决定拒绝“。,从而判定对应的解释变量是否应包含在模型中。

本题对六个回归方程进行参数的显著性检验,EVIEWS软件的回归结果见

附录二,观察各个方程中每个回归变量/统计量对应概率〃值的大小,可以得出

变量不,七,七的/统计量对应概率〃值基本上小于给定显著性水平通过

参数的显著性检验;而变量不毛的/统计量对应概率〃值基本上大于3=01,

不通过参数的显著性检验。

综合以上两点,如果要用气象因素来提高负荷预测精度,在这五个气象因

素中,我优先推荐平均温度、相对湿度、降雨量这三个气象因素。

三、问题三的分析与求解

时间序列乘积季节模型原理

当序列具有短期相关性时,通常可以使用低阶AAMA(PM)模型提取。

当序列具有季节效应,季节效应本身还具有相关性时,季节相关性可以使

用以周期步长为单位的AKMA(匕Q)模型提取。

由于短期相关性和季节效应之间具有乘积关系,因此拟合模型实质为

与ARM4P,Q)的乘积。综合前面的”阶趋势差分和。阶以周期5

为步长的季节差分运算,对原观察值序列拟合的乘积季节模型比5】结构如下:

▽勺%_。(8)兔(8)

(18)

s1①(8)①式⑶'

6(B)="£&------。尸

式中.①⑶句-妙_尸

QS

%(8)=1-疗----0QB

①S(B)=]_4BS------ps

(ppB

该乘积季节模型简记为AR/M4〃/,P)x(P,DQ)s。

具体建模

本文针对问题三,在EVIEWS软件做出两个地区原序列的时序图与差分后

时序图。

1)确定时间序列季节乘积模型:首先考虑的是简单加法季节模型拟合原始

序列再对7天各个时间节点的电负荷量进行预测,进行模型检验时,产生的残

差序列延迟6步、12步、18步的。统计量对应概率值均小于3=0.05

,说明残差序列为非白噪声序列,不通过模型的残差检验,可以得出模型

对序列信息的提取不够充分的结论。充分说明序列的季节效应、长期趋势效应

和随机波动间有着复杂的交互影响关系,使用简单的AR/A%模型不足以提取其

中的相关关系,所以这时我们考虑使用乘积季节模型对原序列进行拟合。

1000

6.C00.

4000•

—05

8C40

地区二原序列时序图地区二差分后时序图

图3时序图

两个地区2009年1月1日——2015年1月10日的电力负荷序列时序图显

示该序列具有长期递增趋势和以年为周期的季节效应,先对序列最一阶差分消

除线性增长趋势,每隔15分钟做一次记录,所以该序列周期步长为35040

(365x96),接下来再做一阶步长为35040的差分消除序列周期性。

2)模型定阶:首先考虑I阶3504。步差分过后,序列12阶以内的自相关

系数和偏自相关系数的特征,以确定短期相关模型。考察两个地区序列差分后

自相关图和偏自相关图(见附录三),自相关图和偏向相关图显示12阶以内的

偏相关系数2阶截尾,所以尝试使用模型提取差分后序列的短

期相关信息。使用4RMA(1,1)3504G模型提取差分后序列的季节相关信息。

综合前面的信息我们要拟合的乘积季节模型为AR/MA((1,2),1,0)x(1,。』):5Mo

即:▽▽3504。%=15^。一%。4心”由)马

(19)

1Y\"

3)模型拟合:使用最小二乘估计方法,确定拟合该模型的口径为:

tM

地区一:▽%504(内=上丝叱(1-0.292B35。应

3504。,]_0.9878,

地区二:▽▽X=上22%(1+0.292针碗)与

35040,1_0.9598

4)序列预测:使用该模型预测两个地区2015年1月11R——1月17日的

电力负荷(每间隔15min),负荷预测结果见附件与附件。

地区工电力自有序列拟合效果图〃地区一电力保荷拟合效臬•

图4乘积季节模型拟合效果图

在不知道实际负荷数据的条件下,本文推断预测结果的准确度较高。从图

4两个地区电力负荷序列模型拟合效果图可以看出,拟合出的图曲线与原差分

后序列接近程度较高,残差曲线在()附近波动;因为两个时间序列乘积季节模

型均通过了参数的显著性检验,充分说明模型参数的选取是合理的;模型产生

的残差序列为白噪声序列,不具有短期相关性,通过了残差检验,表明模型对

原序列的信息提取较为充分,综合以上三个方面说明模型合理有效,使用该模

型进行预测,预测的结果必然准确度较高。

四、问题四的分析与求解

主成分分析

本文有最高温度、最低温度、平均气温、相对湿度、降雨量五个气象因

素,每个变量都在不同程度上反映了研究问题的模型特征,但指标之间彼此有

一定的相关性,因而所得的统计数据反应的信息在一定程度上有所重叠。

主成分分析旨在利用降维的思想,把多指标转化为较少几个综合指标,用

较少的几个综合指标来代替原来的指标,而且这些较少的综合指标能尽量多的

反映原来较多变量指标所反映的信息,同时综合指标之间是彼此独立的。

假定有〃个样本,每个样本有〃个变量,构成一个〃X〃阶的数据矩阵:

X”超XP

X_“21X22…X2p

4■•

一汨匕2…X”,

主成分分析具体过程如下:

1)将原始数据标准化为10,1]之间的有效数据

(2)计算相关系数矩阵:

/电…如

式中:%=2,…p)为原变量的七与〜•之间的相关系数,其计算公式为:

Z("E)(4-引

%=-F=^------------------(20)

、愎“用茂(与-居尸

Vhie

因为R是实对称矩阵(即%,只需要计算上三角元素或者下三角元素

即可;

(3)计算特征值与特征向量:

首先解特征方程|〃-4=0,用雅可比法求出特征值4(i=l,2,〃),并使其

按大小顺序排列;然后分别求出各个特征值对应的特征向量:q(i=1,2,〃);

(4)计算主成分贡献率及累计贡献率:

主成分马的贡献率为:-^-(z=I,2,p)(21)

LA-

«=1

累计贡献率为:量一(i=12…P)(22)

k=\

一般取累计贡献率达到85%~95%的特征值4,否,…4”所对应的第一、第

二、第一(加Wp)个主成分;

(5)新样本矩阵的构造:

定义:记不当,・七为原变量指标,Z]—,…Z,”(机《〃)为新变量指标,根据

下式计算每个主成分的各个样本值。

4,内+勺々+…+a科

z2=a2ix^a12x2+-+。2Pxp

|5”=《川玉+42工2++5Xp

打+…+%:=1

系数%的确定原则:

①Zj与Zj(i*j;i,j=1,2,m)相互无关;

②4是XT,…〜的所有线性组合中方差最大者,z2是与4不相关的

%,当,…〜的所有线性组合方差最大者;z”,是与z„z2,..zw_,都不相关的

…品的所有线性组合中方差最大者。则新变量指标4:2,…z,〃分别称为原

变量指标…%的第1,第2,,第机主成分,它们分别是相关矩阵,〃个

较大特征值所对应的特征向量。

LMBP建模具体求解

在传统BP网络预测的学习过程中,分别通过正向传播和反向传播两个过

程的交替进行,在权向量空间执行误差函数梯度下降策略,动态迭代搜索一组

权向量,使网络误差值达到最小值,来完成信息提取和记忆两个过程

传统BP算法采用的最速下降算法,在开始几步下降相对较快,但随着接

近最优值,目标函数下降逐渐变缓;牛顿法则可在最优值附近提供一个理想的

搜索方向。Levenberg-Marquardt法实际上就是梯度下降法和牛顿法的结合,而

且网络权值数目较少时收敛速度非常迅速。

针对标准BP神经网络算法固有的一些缺陷,考虑到实验样本数目和网络

的收敛速度,本文引入Levenberg-Marquardt算法俗-7|进行网络学习。算法基本

思想是使每次迭代不在沿着单一负梯度方向,而是允许误差沿着恶化的方向进

行搜索,同时通过在最速梯度下降法和牛顿法之间自适应调整来优化网络权

值,使网络有效收敛,提高了网络的收敛速度和泛化能力。

L-M优化算法的权值调整公式为:43=(b+〃/)/>(24)

式中:e为误差向量,,为误差对权值微分的雅克比矩阵,〃为一个标量,当

〃增加时,它接近于具有较小的学习速率的下降法,当〃下降到()时,该算法

就变成了高斯一牛顿法

基于主成分分析LMBP电力负荷预测步骤如下:

(1)主成分分析处理天气因素,将多个有一定相关的气象因素通过主成分

分析法降维处理,用少数不相关气象特征变量来弋表;

(2)数据归一化,将数据处理为[0,1]之间的有效数据。本文采用的归一化

方式为:;=二丁;

尤max—"min

(3)建立LMBP神经网络,包括根据Kolmogorov定理粗略确定网络层

次,层节点数,再多次实验来确定,输出层节点数应与输出量个数相同;

(4)设定训练参数进行训练,完成训练后,调用训练结果,愉入测试数据

进行测试;

(5)得到目标测试数据,进行反归一化,还原为原始范围数据

将相关数据统计整理,导入MATLAB中进行计算(相关程序见附录四),结

果见附件与附件。

模型对比评价

我认为本题与原有的预测结果相比,计及气象因素引影响的负荷预测结果

精度提高了。因为一方面使用本问题的LMBP模型,不仅使用以往的历史负荷

数据训练神经网络模型,在此基础上在进行电力负荷序列预测是引入了气象因

素作为影响因素,相较于此前单单以历史数据拟合模型作为预测模型,考虑更

为全面,且经过验证气象因素确实可以对电力负荷产生一定程度的影响;另一

方面,相比于前面建立的模型,本题建立的LMBP模型的离差平方和有所降

低,表示此模型对原有序列信息的提取更加充分,进一步说明与原有的预测结

果相比,计及气象因素引影响的负荷预测结果精度有所提高。

五、问题五的分析与求解

数据综合评价

根据上文对两地负荷规律性分别统计分析法、时间序列法和人工智能算法

三种方式研究,现选取三种方式中具有代表性的参数来综合比较两地区负荷分

布规律,如表2所示。

表5相关参数表

日峰谷差方回归方程平均离差乘积季节模型离差LMBP模型

差平方和平方和training:R

地区1xio^X104

地区2X109X104

由上表可知:地区2的日峰谷差方差相对于地区1较小,说明地区2负荷-

数据波动范围较小;地区2

回归方程平均离差平方和与乘积季节模型离差平方和相对于地区1较小,

反映模型对原序列的信息提取比较充分,从而说明了地区2负荷数据规律较

强;在LMBP模型中,地区2的training:R(网络学习正确率)虽然较小,但相

对地区1较大,说明地区2负荷数据规律性更好,综上所述,地区2负荷数据

规律性更优。

数据黄金比例评价

许多专家学者指出,“黄金分割率”不但具有美学观点更具有达到机能的

目的。比如,建筑物、画框、扑克牌和书籍等,长和宽的比例都卜分接近于

“黄金分割率”。

黄金分割线股市⑻

中最常见、最受欢迎的切线分析工具之一,主要运用黄金分割来揭示上涨

行情的调整支撑位或下跌行情中的反弹压力位。不过,黄金分割线没有考虑到

时间变化对股价的影响,所揭示出来的支撑位与压力位较为固定,投资者不知

道什么时候会到达支撑位与压力位。因此,如果指数或股价在顶部或底部横盘

运行的时间过长,则其参考作用则要打一定的折扣,但这丝毫不影响黄金分割

线的实用价值。

黄金分割线是利层黄金分割比率进行的切线画法,在行情发生转势后,无

论是止跌转升或止升转跌,以近期走势中重要的高点和低点之间的涨跌幅作为

计量的基数,将原涨跌幅按,、、、分割为5个黄金点,股价在反转后的走势

将可能在这些黄金分割点上遇到暂时的阻力或支撑。其中黄金分割线中运用最

经典的数字为、,极易产生支撑与压力。

同样的在本题负荷数据规律也呈现股价变化类似规律,所以同样的可以利

用黄金分割线来对数据进行分析。根据分析,地区2的负荷数据的走势更贴近

于黄金分割线的划分,从而更进一步说明地区2的数据规律更优。

§6模型的评价与推广

一、模型的优缺点

模型优点

1)本文用于模型计算的数据量足够大,使得相关计算和预测结果可信度较高;

2)本文模型建立模型考虑因素全面合理,使得模型适用性较为广泛;

3)本文在选择预测算法为改进后的算法,使得本文相关预测结果相对更为准

确;

4)本文从不同角度全面具体地证明了地区2较地区1数据分布规律更优;

5)本文选取乘积季节模型,相比于一般的简单季节模型,时间序列乘积季节模

型能同时更好的反映序列的季节效应、长期趋势效应。

模型缺点

1)虽然相关算法已为改进后的算法,但仍存在一些固有的缺陷,导致预测数据

存在一定程度的误差;

2)本文将选取五个天气因素,忽略了其他因素对用电负荷量的影响,也会导致

模型的拟合存在一定程度的误差,进而引起预测的结果存在不可控误差。

二、模型的推广

由于本文模型考虑因素较多,所以使得模型应用相对较为广泛。例如可以

用来预测某地区自来水用量或是对股市大致走势进行简单预测。

参考文献

[1]王学民.应用多元分析[M].上海财经大学出版社,2009.

[2]毛李帆,江岳春,龙瑞华,等.基于偏最小二乘回归分析的中长期电力负荷预测

[J].电网技术,2008(19):71-77.

[3]李子奈.计量经济学应用研究的总体回归模型设定[J].经济研究,2008(8):136-

144.

[4]万昆,柳瑞禹.区间时间序列向量自回归模型在短期电力负荷预测中的应用

[JJ.电网技术,2012,36(11):77-81.

[5]工燕.应用时间序列分析[M].中国人民大学出版社,2012.

[61张淑清,任爽,师荣艳,等.基于多变量气象因子的LMBP电力日负荷预测[J].

仪器仪表学报,2015,36(7):1646-1652.

[7]史峰.MATLAB智能算法30个案例分析[M].北京航空航天大学出版社,

2011.

[8]谢先武.证券投资中的数学方法[J].科学中国人,2000(9):63-64..

附录

附录一:

Al=xlsread(");

A2=xlsread(");%读入两个地区全年的电负荷矩阵

M1=zeros(size(A1));

M2=zeros(size(A2));

MI=sort(Al,2);

M2=sort(A2,2);%按照行升序排列电负荷矩阵

C12=M2(:,1);%两个地区日最低负荷

C21=M1(:,96);

C22=M2(:,96);%两个地区日最高负荷

C31=C21-C11;

C32=C22-C12;%两个地区日峰谷差值

C4l=sum(M1,2)./96;

C42=sum(M2,2)./96;%两地区日负荷均值

C51=C41./C21;

C52=C42./C22%两地区日负荷率

t=l:1:365;

subplot(2,2,l);

plot(t,C21/g');holdon

plot(t,C22,T);%最高负荷

legendC地区1:地区2');

subplot(2,2,2);

plot(t,Cl1/g');holdon

pk)t(t,C12,T);%最低

legend。地区地区2);

subplot(2,2,3);

plot(t,C31,'g');holdon

plot(t,C32厅);%日峰谷差

legend('地区1:地区2');

subplot(2,2,4);

plot(t,C51,'g');holdon

pk)t(t,C52,f);%日负荷率

legend('地区地区2');

al=xlsread(");

a2=xlsread(");%读入两个地区全年的电负荷矩阵

Bl=al(:,4:4:96);

B2=a2(:,4:4:96);%提取整点电力负荷

t=l:18760;

C1=B1.*B1;

C2=B2.*B2;

Dl=sum(Cl,2);

D2=sum(C2,2);

El=sqrt(Dl/24);

E2二sqrl(D2/24);%求出全天电力负荷

c1=sort(EL'dcsccnd');

e2=sort(E2,'descend');%对全天电力负荷降序排列

n=24;

zl=el*ones(l,n);

z2=e2*ones(1,n);%用全天电力负荷替换全天各小时电力负荷

fl=reshape(z「,876(),1);

f2=reshape(z2,,8760,1);

»stairs(t,fl,'g');holdon

stairs(t,f2,T);%做出全年负荷持续性阶梯曲线

附录二:

DependentVanaweY1DependentVariable.Y1

MethodLeastSquaresMethodLeastSquares

Date05^7/16Time20:12Date05/27/16Time20:50

Sample11096Sample:11096

Includedobservations1095Includedobservations1094

VanableCoefhaentSid.&ror^StatisticProbVariableCoefficientStdEnort-StatisticProb.

CC

5583530402151313.8838100000400641231623601266906oooco

X1-39.0917629.45)15-132738801847X1191848320951650915671036C0

X2120771859.40303203292000423X2263223510504102.50591200124

X3120.851877.8430615524070.1209X3150401227.015045.567313OOOCO

X4-12.717544.412320-28819530.0040X4-19.691733.649416-5.395858OOOCO

X55.8148073234132179778300725X5294523025785101/p>

R-squared0.388324Meandependentvar8791334R-squared0560398Meandependentvar6736338

AdjustedR-squared0.385516S.Ddependentvar1935.364AdjustedR-squared0558377SDdependentvar1583CU7

S.E.ofregression1517.114Akaikehfocriterion17.49247S.E.ofregression1052.009Alcaikeinfoentenon1676026

Sumsquaredresid2.51E*O9Schwarzcriterion17.51986Sumsquaredresid1.20E*09Schwarzcriterion16.78767

Loglikelihood■9571.128HannarvQuinnenter.17.50284Loglikelihood-9161.863Hannan>Quinnenter.16.77063

F-statistic138.2708Durbin-Watsonstat

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论