统计分析 主成分分析精品文稿.ppt
《统计分析 主成分分析精品文稿.ppt》由会员分享,可在线阅读,更多相关《统计分析 主成分分析精品文稿.ppt(26页珍藏版)》请在淘文阁 - 分享文档赚钱的网站上搜索。
1、统计分析 主成分分析第1页,本讲稿共26页问题的提出主成分分析方法(principal component analysis,PCA)就是综合处理这种问题的一种强有力的工具。它把原来多个变量(显式变量)转化为少数几个综合变量(潜式变量)。综合变量即主成分(principal compontent)综合变量之间相互独立,且能反映原来多个变量的大部分信息。主成分分析采用的主要原则是使方差最大,以期尽可能多的保留原有变量所包含的信息,同时又能用尽可能少的主成分替代原有变量,从而使问题变的简便。但是,这些主成分通常并没有明确的专业意义。因子分析是主成分分析的一种推广。它从一定的模型出发,找出几个反映原
2、有变量的公共因子,并力求使之有较为合理的专业解释。8 主成分分析第2页,本讲稿共26页8 主成分分析问题的提出 引例8-1 2000年全国各地区经济效益主要指标有以下8个:GDP(亿元)、工业增加值(%)、总资产贡献率(%)、资产负债率(%)、流动资产周转次数(次/年)、工业成本费用利润率(%)、全员劳动生产率(元/人.年)、产品销售率(%)。第3页,本讲稿共26页8 主成分分析第4页,本讲稿共26页8 主成分分析问题的提出第5页,本讲稿共26页8 主成分分析问题的提出第6页,本讲稿共26页8 主成分分析 什么是主成分分析 主成分分析的数学模型 主成分分析的主要步骤 如何在SPSS软件中进行主
3、成分分析第7页,本讲稿共26页8 主成分分析什么是主成分分析 主成分概念首先由Kal parson在1901年提出,不过当时只对非随机变量来讨论的。1933年Hotelling将这个概念推广到随机向量。主成分分析(Principal Components Analysis,PCA)也称为主分量分析,是一种通过降维来简化数据结构的方法,即如何把多个变量(变量)转化为少数几个综合变量(综合变量),而这几个综合变量可以反映原来多个变量的大部分信息。为了使这些综合变量所含的信息互不重叠,应要求它们之间互不相关。第8页,本讲稿共26页8 主成分分析什么是主成分分析在实际问题中,经常遇到多变量(指标)问题
4、,而且变量之间有一定的相关性。变量多且变量间有一定的相关性,势必增加了分析问题的复杂性。主成分分析就是设法将原来变量重新组合成一组新的互相无关的几个综合变量来代替原来变量,同时根据实际需要从中可取几个较少的综合变量尽可能多地反映原来变量的信息。第9页,本讲稿共26页8 主成分分析基本思想主成分分析就是设法将原来众多具有一定相关性的变量(如p个变量),重新组合成一组新的相互无关的综合变量来代替原来变量。怎么处理?通常数学上的处理就是将原来p个变量作线性组合作为新的综合变量。如何选择?如果将选取的第一个线性组合即第一个综合变量记为F1,自然希望F1尽可能多的反映原来变量的信息。怎样反映?最经典的方
5、法就是用方差来表达,即var(F1)越大,表示F1包含的信息越多。因此在所有的线性组合中所选取的F1应该是方差最大的,故称之为第一主成分(principal component I)。第10页,本讲稿共26页8 主成分分析 基本思想如果第一主成分不足以代表原来p个变量的信息,再考虑选取F2即第二个线性组合。F2称为第二主成分(principal component II)。F1和F2的关系?为了有效地反映原来信息,F1已有的信息就不再出现在F2中,即cov(F1,F2)0。依此类推,可以获得p个主成分。因此,这些主成分之间是互不相关的,而且方差依次递减。在实际中,挑选前几个最大主成分来表征。标
- 配套讲稿:
如PPT文件的首页显示word图标,表示该PPT已包含配套word讲稿。双击word图标可打开word文档。
- 特殊限制:
部分文档作品中含有的国旗、国徽等图片,仅作为作品整体效果示例展示,禁止商用。设计者仅对作品中独创性部分享有著作权。
- 关 键 词:
- 统计分析 主成分分析精品文稿 成分 分析 精品 文稿
限制150内