1 / 38
文档名称:

35主成分分析方法.pptx

格式:pptx   大小:780KB   页数:38页
下载后只包含 1 个 PPTX 格式的文档,没有任何的图纸或源代码,查看文件列表

如果您已付费下载过本站文档,您可以点这里二次下载

分享

预览

35主成分分析方法.pptx

上传人:wz_198613 2018/11/26 文件大小:780 KB

下载得到文件列表

35主成分分析方法.pptx

文档介绍

文档介绍:第五节主成分分析方法
主成分分析的基本原理
主成分分析的计算步骤
主成分分析方法应用实例
库文档分享
地理系统是多要素的复杂系统。在地理学研究中,多变量问题是经常会遇到的。变量太多,无疑会增加分析问题的难度与复杂性,而且在许多实际问题中,多个变量之间是具有一定的相关关系的。
因此,人们会很自然地想到,能否在相关分析的基础上,用较少的新变量代替原来较多的旧变量,而且使这些较少的新变量尽可能多地保留原来变量所反映的信息?
问题的提出:
库文档分享
事实上,这种想法是可以实现的,主成分分析方法就是综合处理这种问题的一种强有力的工具。
主成分分析是把原来多个变量划为少数几个综合指标的一种统计分析方法。
从数学角度来看,这是一种降维处理技术。
库文档分享
一、主成分分析的基本原理
假定有n个地理样本,每个样本共有p个变量,构成一个n×p阶的地理数据矩阵
()
库文档分享
当p较大时,在p维空间中考察问题比较麻烦。为了克服这一困难,就需要进行降维处理,即用较少的几个综合指标代替原来较多的变量指标,而且使这些较少的综合指标既能尽量多地反映原来较多变量指标所反映的信息,同时它们之间又是彼此独立的。
库文档分享
定义:记x1,x2,…,xP为原变量指标,z1,z2,…,zm(m≤p)为新变量指标
()
系数lij的确定原则:
① zi与zj(i≠j;i,j=1,2,…,m)相互无关;
库文档分享
② z1是x1,x2,…,xP的一切线性组合中方差最大者,z2是与z1不相关的x1,x2,…,xP的所有线性组合中方差最大者;
……
zm是与z1,z2,……,zm-1都不相关的x1,x2,…xP, 的所有线性组合中方差最大者。

则新变量指标z1,z2,…,zm分别称为原变量指标x1,x2,…,xP的第一,第二,…,第m主成分。
库文档分享
从以上的分析可以看出,主成分分析的实质就是确定原来变量xj(j=1,2 ,…, p)在诸主成分zi(i=1,2,…,m)上的荷载 lij( i=1,2,…,m; j=1,2 ,…,p)。
从数学上容易知道,从数学上可以证明,它们分别是的相关矩阵的m个较大的特征值所对应的特征向量。
库文档分享
二、计算步骤
(一)计算相关系数矩阵

rij(i,j=1,2,…,p)为原变量xi与xj的相关系数, rij=rji,其计算公式为:
()
()
库文档分享
(二)计算特征值与特征向量:
①解特征方程,常用雅可比法(Jacobi)求出特征值,并使其按大小顺序排列;
②分别求出对应于特征值的特征向量
,要求=1,即,其中表示向量的第j个分量。
库文档分享