应用多元统计分析课后答案_朱建平版(66页).doc
《应用多元统计分析课后答案_朱建平版(66页).doc》由会员分享,可在线阅读,更多相关《应用多元统计分析课后答案_朱建平版(66页).doc(67页珍藏版)》请在淘文阁 - 分享文档赚钱的网站上搜索。
1、-第二章2.1.试叙述多元联合分布和边际分布之间的关系。解:多元联合分布讨论多个随机变量联合到一起的概率分布状况,的联合分布密度函数是一个p维的函数,而边际分布讨论是的子向量的概率分布,其概率密度函数的维数小于p。2.2设二维随机向量服从二元正态分布,写出其联合分布。解:设的均值向量为,协方差矩阵为,则其联合分布密度函数为。2.3已知随机向量的联合密度函数为其中,。求(1)随机变量和的边缘密度函数、均值和方差;(2)随机变量和的协方差和相关系数;(3)判断和是否相互独立。(1)解:随机变量和的边缘密度函数、均值和方差; 所以由于服从均匀分布,则均值为,方差为。同理,由于服从均匀分布,则均值为,
2、方差为。(2)解:随机变量和的协方差和相关系数; (3)解:判断和是否相互独立。和由于,所以不独立。2.4设服从正态分布,已知其协方差矩阵S为对角阵,证明其分量是相互独立的随机变量。解: 因为的密度函数为又由于则则其分量是相互独立。2.5由于多元正态分布的数学期望向量和均方差矩阵的极大似然分别为 注:利用 , S 其中 在SPSS中求样本均值向量的操作步骤如下:1. 选择菜单项AnalyzeDescriptive StatisticsDescriptives,打开Descriptives对话框。将待估计的四个变量移入右边的Variables列表框中,如图2.1。 图2.1 Descriptiv
3、es对话框2. 单击Options按钮,打开Options子对话框。在对话框中选择Mean复选框,即计算样本均值向量,如图2.2所示。单击Continue按钮返回主对话框。 图2.2 Options子对话框3. 单击OK按钮,执行操作。则在结果输出窗口中给出样本均值向量,如表2.1,即样本均值向量为(35.3333,12.3333,17.1667,1.5250E2)。 表2.1 样本均值向量在SPSS中计算样本协差阵的步骤如下:1. 选择菜单项AnalyzeCorrelateBivariate,打开Bivariate Correlations对话框。将三个变量移入右边的Variables列表框
4、中,如图2.3。 图2.3 Bivariate Correlations对话框2. 单击Options按钮,打开Options子对话框。选择Cross-product deviations and covariances复选框,即计算样本离差阵和样本协差阵,如图2.4。单击Continue按钮,返回主对话框。 图2.4 Options子对话框3. 单击OK按钮,执行操作。则在结果输出窗口中给出相关分析表,见表2.2。表中Covariance给出样本协差阵。(另外,Pearson Correlation为皮尔逊相关系数矩阵,Sum of Squares and Cross-products为样本
5、离差阵。) 2.6 渐近无偏性、有效性和一致性;2.7 设总体服从正态分布,有样本。由于是相互独立的正态分布随机向量之和,所以也服从正态分布。又所以。2.8 方法1: 。方法2: 。故为的无偏估计。2.9.设是从多元正态分布抽出的一个简单随机样本,试求的分布。证明: 设为一正交矩阵,即。令,所以。且有,。所以独立同分布。又因为因为又因为所以原式故,由于独立同正态分布,所以2.10.设是来自的简单随机样本,(1)已知且,求和的估计。(2)已知求和的估计。解:(1), (2) 解之,得,第三章3.1 试述多元统计分析中的各种均值向量和协差阵检验的基本思想和步骤。其基本思想和步骤均可归纳为:答: 第
6、一,提出待检验的假设和H1;第二,给出检验的统计量及其服从的分布;第三,给定检验水平,查统计量的分布表,确定相应的临界 值,从而得到否定域;第四,根据样本观测值计算出统计量的值,看是否落入否定域中,以便对待判假设做出决策(拒绝或接受)。均值向量的检验: 统计量 拒绝域均值向量的检验:在单一变量中当已知 当未知 (作为的估计量)一个正态总体协差阵已知 协差阵未知 () 两个正态总体有共同已知协差阵 有共同未知协差阵 (其中 )协差阵不等 协差阵不等 多个正态总体单因素方差 多因素方差 协差阵的检验检验 检验 统计量3.2 试述多元统计中霍特林分布和威尔克斯分布分别与一元统计中t分布和F分布的关系
7、。答:(!)霍特林分布是t分布对于多元变量的推广。而若设,且与相互独立,则称统计量的分布为非中心霍特林T2分布。若,且与相互独立,令,则 。(2)威尔克斯分布在实际应用中经常把统计量化为统计量进而化为统计量,利用统计量来解决多元统计分析中有关检验问题。 与统计量的关系统计量及分别任意任意1任意任意21任意任意2任意任意3.3 试述威尔克斯统计量在多元方差分析中的重要意义。答:威尔克斯统计量在多元方差分析中是用于检验均值的统计量。 用似然比原则构成的检验统计量为 给定检验水平,查Wilks分布表,确定临界值,然后作出统计判断。第四章4.1 简述欧几里得距离与马氏距离的区别和联系。答: 设p维欧几
8、里得空间中的两点X=和Y=。则欧几里得距离为。欧几里得距离的局限有在多元数据分析中,其度量不合理。会受到实际问题中量纲的影响。设X,Y是来自均值向量为,协方差为的总体G中的p维样本。则马氏距离为D(X,Y)=。当即单位阵时,D(X,Y)=即欧几里得距离。因此,在一定程度上,欧几里得距离是马氏距离的特殊情况,马氏距离是欧几里得距离的推广。4.2 试述判别分析的实质。答:判别分析就是希望利用已经测得的变量数据,找出一种判别函数,使得这一函数具有某种最优性质,能把属于不同类别的样本点尽可能地区别开来。设R1,R2,Rk是p维空间R p的k个子集,如果它们互不相交,且它们的和集为,则称为的一个划分。判
9、别分析问题实质上就是在某种意义上,以最优的性质对p维空间构造一个“划分”,这个“划分”就构成了一个判别规则。4.3 简述距离判别法的基本思想和方法。答:距离判别问题分为两个总体的距离判别问题和多个总体的判别问题。其基本思想都是分别计算样本与各个总体的距离(马氏距离),将距离近的判别为一类。两个总体的距离判别问题设有协方差矩阵相等的两个总体G1和G2,其均值分别是m1和m 2,对于一个新的样品X,要判断它来自哪个总体。计算新样品X到两个总体的马氏距离D2(X,G1)和D2(X,G2),则 X ,D2(X,G1)D2(X,G2)X ,D2(X,G1) D2(X,G2,具体分析, 记 则判别规则为
10、X ,W(X)X ,W(X)0多个总体的判别问题。设有个总体,其均值和协方差矩阵分别是和,且。计算样本到每个总体的马氏距离,到哪个总体的距离最小就属于哪个总体。具体分析, 取,。可以取线性判别函数为, 相应的判别规则为 若 4.4 简述贝叶斯判别法的基本思想和方法。基本思想:设k个总体,其各自的分布密度函数,假设k个总体各自出现的概率分别为,。设将本来属于总体的样品错判到总体时造成的损失为,。设个总体相应的维样本空间为 。在规则下,将属于的样品错判为的概率为 则这种判别规则下样品错判后所造成的平均损失为 则用规则来进行判别所造成的总平均损失为 贝叶斯判别法则,就是要选择一种划分,使总平均损失达
11、到极小。基本方法:令,则 若有另一划分,则在两种划分下的总平均损失之差为 因为在上对一切成立,故上式小于或等于零,是贝叶斯判别的解。从而得到的划分为 4.5 简述费希尔判别法的基本思想和方法。答:基本思想:从个总体中抽取具有个指标的样品观测数据,借助方差分析的思想构造一个线性判别函数 系数可使得总体之间区别最大,而使每个总体内部的离差最小。将新样品的个指标值代入线性判别函数式中求出值,然后根据判别一定的规则,就可以判别新的样品属于哪个总体。4.6 试析距离判别法、贝叶斯判别法和费希尔判别法的异同。答: 费希尔判别与距离判别对判别变量的分布类型无要求。二者只是要求有各类母体的两阶矩存在。而贝叶斯
12、判别必须知道判别变量的分布类型。因此前两者相对来说较为简单。 当k=2时,若则费希尔判别与距离判别等价。当判别变量服从正态分布时,二者与贝叶斯判别也等价。 当时,费希尔判别用作为共同协差阵,实际看成等协差阵,此与距离判别、贝叶斯判别不同。 距离判别可以看为贝叶斯判别的特殊情形。贝叶斯判别的判别规则是 X ,W(X)X ,W(X)lnd距离判别的判别规则是 X ,W(X)X ,W(X)0二者的区别在于阈值点。当,时,。二者完全相同。4.7 设有两个二元总体和 ,从中分别抽取样本计算得到 , 假设,试用距离判别法建立判别函数和判别规则。 样品X=(6,0)应属于哪个总体?解:= ,= , =即样品
13、X属于总体4.8 某超市经销十种品牌的饮料,其中有四种畅销,三种滞销,三种平销。下表是这十种品牌饮料的销售价格(元)和顾客对各种饮料的口味评分、信任度评分的平均数。销售情况产品序号销售价格口味评分信任度评分畅销12.25822.56733.03943.286平销52.87663.58774.898滞销81.73492.242102.743 根据数据建立贝叶斯判别函数,并根据此判别函数对原样本进行回判。 现有一新品牌的饮料在该超市试销,其销售价格为3.0,顾客对其口味的评分平均为8,信任评分平均为5,试预测该饮料的销售情况。解:增加group变量,令畅销、平销、滞销分别为group1、2、3;销
14、售价格为X1,口味评分为X2,信任度评分为X3,用spss 解题的步骤如下:1. 在SPSS窗口中选择AnalyzeClassifyDiscriminate,调出判别分析主界面,将左边的变量列表中的“group”变量选入分组变量中,将X1、X2、X3变量选入自变量中,并选择Enter independents together单选按钮,即使用所有自变量进行判别分析。2. 点击Define Range按钮,定义分组变量的取值范围。本例中分类变量的范围为1到3,所以在最小值和最大值中分别输入1和3。单击Continue按钮,返回主界面。如图4.1 图4.1 判别分析主界面3. 单击Statisti
15、cs按钮,指定输出的描述统计量和判别函数系数。选中Function Coefficients栏中的Fishers:给出Bayes判别函数的系数。(注意:这个选项不是要给出Fisher判别函数的系数。这个复选框的名字之所以为Fishers,是因为按判别函数值最大的一组进行归类这种思想是由Fisher提出来的。这里极易混淆,请读者注意辨别。)如图4.2。单击Continue按钮,返回主界面。 图4.2 statistics子对话框4. 单击Classify按钮,弹出classification子对话框,选中Display选项栏中的Summary table复选框,即要求输出错判矩阵,以便实现题中对
16、原样本进行回判的要求。如图4.3。 图4.3 classification对话框5. 返回判别分析主界面,单击OK按钮,运行判别分析过程。1) 根据判别分析的结果建立Bayes判别函数:Bayes判别函数的系数见表4.1。表中每一列表示样本判入相应类的Bayes判别函数系数。由此可建立判别函数如下:Group1: Group2: Group3: 将各样品的自变量值代入上述三个Bayes判别函数,得到三个函数值。比较这三个函数值,哪个函数值比较大就可以判断该样品判入哪一类。 Classification Function Coefficientsgroup123x1-11.689-10.707-
17、2.194x212.29713.3614.960x316.76117.0866.447(Constant)-81.843-94.536-17.449Fishers linear discriminant functions 表4.1 Bayes判别函数系数根据此判别函数对样本进行回判,结果如表4.2。从中可以看出在4种畅销饮料中,有3种被正确地判定,有1种被错误地判定为平销饮料,正确率为75%。在3种平销饮料中,有2种被正确判定,有1种被错误地判定为畅销饮料,正确率为66.7%。3种滞销饮料均正确判定。整体的正确率为80.0%。Classification ResultsagroupPredi
18、cted Group MembershipTotal123OriginalCount131042120330033%175.025.0.0100.0233.366.7.0100.03.0.0100.0100.0a. 80.0% of original grouped cases correctly classified. 表4.2 错判矩阵2) 该新饮料的,将这3个自变量代入上一小题得到的Bayes判别函数,的值最大,该饮料预计平销。也可通过在原样本中增加这一新样本,重复上述的判别过程,并在classification子对话框中同时要求输出casewise results,运行判别过程,得到相
19、同的结果。4.9 银行的贷款部门需要判别每个客户的信用好坏(是否未履行还贷责任),以决定是否给予贷款。可以根据贷款申请人的年龄()、受教育程度()、现在所从事工作的年数()、未变更住址的年数()、收入()、负债收入比例()、信用卡债务()、其它债务()等来判断其信用情况。下表是从某银行的客户资料中抽取的部分数据,根据样本资料分别用距离判别法、Bayes判别法和Fisher判别法建立判别函数和判别规则。某客户的如上情况资料为(53,1,9,18,50,11.20,2.02,3.58),对其进行信用好坏的判别。目前信用好坏客户序号已履行还贷责任123172316.600.341.712341173
- 配套讲稿:
如PPT文件的首页显示word图标,表示该PPT已包含配套word讲稿。双击word图标可打开word文档。
- 特殊限制:
部分文档作品中含有的国旗、国徽等图片,仅作为作品整体效果示例展示,禁止商用。设计者仅对作品中独创性部分享有著作权。
- 关 键 词:
- 应用 多元 统计分析 课后 答案 建平 66
限制150内