2022年主成分分析原理 .pdf
![资源得分’ title=](/images/score_1.gif)
![资源得分’ title=](/images/score_1.gif)
![资源得分’ title=](/images/score_1.gif)
![资源得分’ title=](/images/score_1.gif)
![资源得分’ title=](/images/score_05.gif)
《2022年主成分分析原理 .pdf》由会员分享,可在线阅读,更多相关《2022年主成分分析原理 .pdf(10页珍藏版)》请在淘文阁 - 分享文档赚钱的网站上搜索。
1、第七章主成分分析(一)教学目的通过本章的学习,对主成分分析从总体上有一个清晰地认识,理解主成分分析的基本思想和数学模型,掌握用主成分分析方法解决实际问题的能力。(二)基本要求了解主成分分析的基本思想,几何解释,理解主成分分析的数学模型,掌握主成分分析方法的主要步骤。(三)教学要点1、主成分分析基本思想,数学模型,几何解释2、主成分分析的计算步骤及应用(四)教学时数3 课时(五)教学内容1、主成分分析的原理及模型2、主成分的导出及主成分分析步骤在实际问题中,我们经常会遇到研究多个变量的问题,而且在多数情况下,多个变量之间常常存在一定的相关性。由于变量个数较多再加上变量之间的相关性,势必增加了分析
2、问题的复杂性。如何从多个变量中综合为少数几个代表性变量,既能够代表原始变量的绝大多数信息,又互不相关,并且在新的综合变量基础上,可以进一步的统计分析,这时就需要进行主成分分析。第一节主成分分析的原理及模型一、主成分分析的基本思想与数学模型(一)主成分分析的基本思想主成分分析是采取一种数学降维的方法,找出几个综合变量来代替原来众多的变量,使这些综合变量能尽可能地代表原来变量的信息量,而且彼此之间互不相关。这种将把多个变量化为少数几个互相无关的综合变量的统计分析方法就叫做主成分分析或主分量分析。名师资料总结 - - -精品资料欢迎下载 - - - - - - - - - - - - - - - -
3、 - - 名师精心整理 - - - - - - - 第 1 页,共 10 页 - - - - - - - - - 主成分分析所要做的就是设法将原来众多具有一定相关性的变量,重新组合为一组新的相互无关的综合变量来代替原来变量。通常,数学上的处理方法就是将原来的变量做线性组合,作为新的综合变量,但是这种组合如果不加以限制,则可以有很多,应该如何选择呢?如果将选取的第一个线性组合即第一个综合变量记为,自然希望它尽可能多地反1F映原来变量的信息,这里“信息 ” 用方差来测量,即希望越大,表示包含的信)(1FVar1F息越多。因此在所有的线性组合中所选取的应该是方差最大的,故称为第一主成分。1F1F如果
4、第一主成分不足以代表原来个变量的信息,再考虑选取即第二个线性组合,为了p2F有效地反映原来信息,已有的信息就不需要再出现在中,用数学语言表达就是要求1F2F,称为第二主成分,依此类推可以构造出第三、四 第个主成分。0),(21FFCov2Fp(二)主成分分析的数学模型对于一个样本资料,观测个变量,个样品的数据资料阵为:ppxxxL,21nnpnnppxxxxxxxxxXLMMMMLL212222111211pxxxL,21其中:pjxxxxnjjjjLM, 2, 1,21主成分分析就是将个观测变量综合成为个新的变量(综合变量) ,即ppppppppppppxaxaxaFxaxaxaFxaxax
5、aFLLLL22112222121212121111简写为:pjpjjjxxxFL2211名师资料总结 - - -精品资料欢迎下载 - - - - - - - - - - - - - - - - - - 名师精心整理 - - - - - - - 第 2 页,共 10 页 - - - - - - - - - pj, 2, 1L要求模型满足以下条件:互不相关(,)jiFF ,jipji, 2, 1,L的方差大于的方差大于的方差,依次类推1F2F3F.,2 , 1122221pkaaakpkkLL于是,称为第一主成分,为第二主成分,依此类推,有第个主成分。主成分1F2Fp又叫主分量。这里我们称为主成
6、分系数。ija上述模型可用矩阵表示为:,其中AXFpFFFFM21pxxxXM21pppppppaaaaaaaaaaaaAMLMMMMLL21212222111211称为主成分系数矩阵。A二、主成分分析的几何解释假设有个样品,每个样品有二个变量,即在二维空间中讨论主成分的几何意义。设n个样品在二维空间中的分布大致为一个椭园,如下图所示:n图 7.1 主成分几何解释图名师资料总结 - - -精品资料欢迎下载 - - - - - - - - - - - - - - - - - - 名师精心整理 - - - - - - - 第 3 页,共 10 页 - - - - - - - - - 将坐标系进行正
7、交旋转一个角度,使其椭圆长轴方向取坐标,在椭圆短轴方向取1y坐标,旋转公式为2ycos)sin(sincos212211jjjjjjxxyxxynjL2, 1写成矩阵形式为:nnyyyyyyY2222111211LLXUxxxxxxnn2222111211cossinsincosLL其中为坐标旋转变换矩阵,它是正交矩阵,即有,即满足UIUUUU,1。1cossin22经过旋转变换后,得到下图的新坐标:图 7.2 主成分几何解释图新坐标有如下性质:21yy(1)个点的坐标和的相关几乎为零。n1y2y(2) 二维平面上的个点的方差大部分都归结为轴上,而轴上的方差较小。n1y2y和称为原始变量和的综
8、合变量。由于个点在轴上的方差最大,因而将1y2y1x2xn1y二维空间的点用在轴上的一维综合变量来代替,所损失的信息量最小,由此称轴为第1y1y一主成分,轴与轴正交,有较小的方差,称它为第二主成分。2y1y名师资料总结 - - -精品资料欢迎下载 - - - - - - - - - - - - - - - - - - 名师精心整理 - - - - - - - 第 4 页,共 10 页 - - - - - - - - - 三、主成分分析的应用主成分概念首先是由Karl parson 在 1901 年引进,但当时只对非随机变量来讨论的。1933 年 Hotelling将这个概念推广到随机变量。特别
9、是近年来,随着计算机软件的应用,使得主成分分析的应用也越来越广泛。其中,主成分分析可以用于系统评估。系统评估是指对系统营运状态做出评估,而评估一个系统的营运状态往往需要综合考察许多营运变量,例如对某一类企业的经济效益作评估,影响经济效益的变量很多,很难直接比较其优劣,所以解决评估问题的焦点是希望客观、科学地将一个多变量问题综合成一个单变量形式,也就是说只有在一维空间中才能使排序评估成为可能,这正符合主成分分析的基本思想。在经济统计研究中,除了经济效益的综合评价研究外,对不同地区经济发展水平的评价研究,不同地区经济发展竞争力的评价研究,人民生活水平、生活质量的评价研究,等等都可以用主成分分析方法
- 配套讲稿:
如PPT文件的首页显示word图标,表示该PPT已包含配套word讲稿。双击word图标可打开word文档。
- 特殊限制:
部分文档作品中含有的国旗、国徽等图片,仅作为作品整体效果示例展示,禁止商用。设计者仅对作品中独创性部分享有著作权。
- 关 键 词:
- 2022年主成分分析原理 2022 成分 分析 原理
![提示](https://www.taowenge.com/images/bang_tan.gif)
限制150内