下载此文档

应用多元统计分析习题解答 朱建平 第四章.pdf


文档分类:高等教育 | 页数:约13页 举报非法文档有奖
1/13
下载提示
  • 1.该资料是网友上传的,本站提供全文预览,预览什么样,下载就什么样。
  • 2.下载该文档所得收入归上传者、原创者。
  • 3.下载的文档,不会出现我们的网址水印。
1/13 下载此文档
文档列表 文档介绍
该【应用多元统计分析习题解答 朱建平 第四章 】是由【小屁孩】上传分享,文档一共【13】页,该文档可以免费在线阅读,需要了解更多关于【应用多元统计分析习题解答 朱建平 第四章 】的内容,可以使用淘豆网的站内搜索功能,选择自己适合的文档,以下文字是截取该文章内的部分文字,如需要获得完整电子版,请下载此文档到您的设备,方便您编辑和打印。:..Abbo无私奉献,只收1个金币,BS收5个金币的…何老师考简单点啊……:..。答:设p维欧几里得空间中的两点X=和Y=。则欧几里得距离为。欧几里得距离的局限有①在多元数据分析中,其度量不合理。②会受到实际问题中量纲的影响。设X,Y是来自均值向量为,协方差为的总体G中的p维样本。则马氏距离为D(X,Y)=。当即单位阵时,D(X,Y)==即欧几里得距离。因此,在一定程度上,欧几里得距离是马氏距离的特殊情况,马氏距离是欧几里得距离的推广。。:..答:判别分析就是希望利用已经测得的变量数据,找出一种判别函数,使得这一函数具有某种最优性质,能把属于不同类别的样本点尽可能地区别开来。设R1,R2,?,Rk是p维空间Rp的k个子集,如果它们互不相交,且它们的和集为,则称为的一个划分。判别分析问题实质上就是在某种意义上,以最优的性质对p维空间构造一个“划分”,这个“划分”就构成了一个判别规则。。答:距离判别问题分为①两个总体的距离判别问题和②多个总体的判别问题。其基本思想都是分别计算样本与各个总体的距离(马氏距离),将距离近的判别为一类。①两个总体的距离判别问题设有协方差矩阵∑相等的两个总体G和G,其均值分别是?和?,对于一个新的样品X,1212要判断它来自哪个总体。计算新样品X到两个总体的马氏距离D2(X,G)和D2(X,G),12则X,D2(X,G)D2(X,G)12X,D2(X,G)>D2(X,G,12具体分析,D2(X,G)?D2(X,G)12?(X?μ)?Σ?1(X?μ)?(X?μ)?Σ?1(X?μ)1122?X?Σ?1X?2X?Σ?1μ?μ?Σ?1μ?(X?Σ?1X?2X?Σ?1μ?μ?Σ?1μ)111222?2X?Σ?1(μ?μ)?μ?Σ?1μ?μ?Σ?1μ211122?2X?Σ?1(μ?μ)?(μ?μ)?Σ?1(μ?μ)211212??μ?μ???2X?12Σ?1(μ?μ)??12?2???2(X?μ)?α??2α?(X?μ)记W(X)?α?(X?μ)则判别规则为:..X,W(X)X,W(X)<0②多个总体的判别问题。设有k个总体G,G,,G,其均值和协方差矩阵分别是μ,μ,,μ和Σ,Σ,,Σ,???12k12k12k且Σ?Σ???Σ?Σ。计算样本到每个总体的马氏距离,到哪个总体的距离最小就属12k于哪个总体。具体分析,D2(X,G)?(X?μ)?Σ?1(X?μ)????X?Σ?1X?2μ?Σ?1X?μ?Σ?1μ????X?Σ?1X?2(I?X?C)??1取I?Σ?1μ,C??μ?Σ?1μ,??1,2,?,k。???2??可以取线性判别函数为W(X)?I?X?C,??1,2,?,k???相应的判别规则为X?G若W(X)?max(I?X?C)ii??1???。基本思想:设k个总体G,G,?,G,其各自的分布密度函数f(x),f(x),?,f(x),假设k12k12kk个总体各自出现的概率分别为q,q,?,q,q?0,?q?1。设将本来属于G总体的样品12kiiii?1错判到总体G时造成的损失为C(j|i),i,j?1,2,?,k。j设k个总体G,G,?,G相应的p维样本空间为R?(R,R,?,R)。12k12k在规则R下,将属于G的样品错判为G的概率为ijP(j|i,R)??f(x)dxi,j?1,2,?,ki?jiRj:..则这种判别规则下样品错判后所造成的平均损失为kr(i|R)??[C(j|i)P(j|i,R)]i?1,2,?,kj?1则用规则R来进行判别所造成的总平均损失为kg(R)??qr(i,R)ii?1kk??q?C(j|i)P(j|i,R)ii?1j?1贝叶斯判别法则,就是要选择一种划分R,R,?,R,使总平均损失g(R)达到极小。12kkk基本方法:g(R)??q?C(j|i)P(j|i,R)ii?1j?1kk??q?C(j|i)?f(x)dxiiRji?1j?1kk???(?qC(j|i)f(x))dxRiij?1ji?1kk令?qC(j|i)f(x)?h(x),则g(R)???h(x)dxiijRji?1j?1jk若有另一划分R*?(R*,R*,?,R*),g(R*)???h(x)dx12k*jRjj?1则在两种划分下的总平均损失之差为kkg(R)?g(R*)????[h(x)?h(x)]dxR?R*iji?1j?1ijj因为在R上h(x)?h(x)对一切成立,故上式小于或等于零,是贝叶斯判别的解。iijR?{x|h(x)?minh(x)}R?(R,R,?,R)iiji?1,2,?,k从而得到的划分12k为1?j?。kp答:基本思想:从个总体中抽取具有个指标的样品观测数据,借助方差分析的思想构造一个线性判别函数:..U(X)?uX?uX???uX?u?X1122pp系数u?(u,u,?,u)?可使得总体之间区别最大,而使每个总体内部的离差最小。将新样12pp品的个指标值代入线性判别函数式中求出U(X)值,然后根据判别一定的规则,就可以判别新的样品属于哪个总体。、贝叶斯判别法和费希尔判别法的异同。答:①费希尔判别与距离判别对判别变量的分布类型无要求。二者只是要求有各类母体的两阶矩存在。而贝叶斯判别必须知道判别变量的分布类型。因此前两者相对来说较为简单。②当k=2时,若则费希尔判别与距离判别等价。当判别变量服从正态分布时,二者与贝叶斯判别也等价。③当时,费希尔判别用作为共同协差阵,实际看成等协差阵,此与距离判别、贝叶斯判别不同。④距离判别可以看为贝叶斯判别的特殊情形。贝叶斯判别的判别规则是X,W(X)X,W(X)<lnd距离判别的判别规则是X,W(X)X,W(X)<0d?1二者的区别在于阈值点。当q?q,C(1|2)?C(2|1)时,,lnd?0。二者完全12:..相同。,从中分别抽取样本计算得到,,假设,试用距离判别法建立判别函数和判别规则。样品X=(6,0)’应属于哪个总体?解:=,=,==,其中有四种畅销,三种滞销,三种平销。下表是这十种品牌饮料的销售价格(元)和顾客对各种饮料的口味评分、信任度评分的平均数。:..⑴根据数据建立贝叶斯判别函数,并根据此判别函数对原样本进行回判。⑵现有一新品牌的饮料在该超市试销,,顾客对其口味的评分平均为8,信任评分平均为5,试预测该饮料的销售情况。解:增加group变量,令畅销、平销、滞销分别为group1、2、3;销售价格为X,口味评1分为X,信任度评分为X,用spss解题的步骤如下:→Classify→Discriminate,调出判别分析主界面,将左边的变量列表中的“group”变量选入分组变量中,将X、X、X变量选入自123变量中,并选择Enterindependentstogether单选按钮,即使用所有自变量进行判别分析。,定义分组变量的取值范围。本例中分类变量的范围为1到3,所以在最小值和最大值中分别输入1和3。单击Continue按钮,返回主界面。…按钮,指定输出的描述统计量和判别函数系数。选中FunctionCoefficients栏中的Fisher’s:给出Bayes判别函数的系数。(注意:这个选项不是要给出Fisher判别函数的系数。这个复选框的名字之所以为Fisher’s,是因为按判别函数值最大的一组进行归类这种思想是由Fisher提出来的。这里极易混淆,请读者注意辨别。)。单击Continue按钮,返回主界面。:..…按钮,弹出classification子对话框,选中Display选项栏中的Summarytable复选框,即要求输出错判矩阵,以便实现题中对原样本进行回判的要求。。,单击OK按钮,运行判别分析过程。1)根据判别分析的结果建立Bayes判别函数:。表中每一列表示样本判入相应类的Bayes判别函数系数。由此可建立判别函数如下:Group1:Y1?????:Y2?????:Y3?????,得到三个函数值。比较这三个函数值,哪个函数值比较大就可以判断该样品判入哪一类。ClassificationFunctionCoefficientsgroup123x1---(Constant)---',。从中可以看出在4种畅销饮料中,有3种被正确地判定,有1种被错误地判定为平销饮料,正确率为75%。在3种平销饮料中,有2种被正确判定,有1种被错误地判定为畅销饮料,%。3种滞销饮料均正确判定。%。ClassificationResultsaPredictedGroupMembershipgroup123TotalOriginalCount1310421203:..30033%%)该新饮料的X1?,X2?8,X3?5,将这3个自变量代入上一小题得到的Bayes判别函数,Y2的值最大,该饮料预计平销。也可通过在原样本中增加这一新样本,重复上述的判别过程,并在classification子对话框中同时要求输出casewiseresults,运行判别过程,得到相同的结果。(是否未履行还贷责任),以决定是否给予贷款。可以根据贷款申请人的年龄(X)、受教育程度(X)、现在所从事工作的年数12(X)、未变更住址的年数(X)、收入(X)、负债收入比例(X)、信用卡债务(X)、34567其它债务(X)等来判断其信用情况。下表是从某银行的客户资料中抽取的部分数据,⑴8根据样本资料分别用距离判别法、Bayes判别法和Fisher判别法建立判别函数和判别规则。⑵某客户的如上情况资料为(53,1,9,18,50,,,),对其进行信用好坏的判别。**********.**********.:令已履行还贷责任为group0,未履行还贷责任为group1。令(53,1,9,18,50,,,)客户序号为11,group未知。用spss解题步骤如下:→Classify→Discriminate,调出判别分析主界面,将左边的变量列表中的“group”变量选入分组变量中,将X1?X6变量选入自变量中,并选择Enterindependentstogether单选按钮,即使用所有自变量进行判别分析。,定义分组变量的取值范围。本例中分类变量的范围为0到1,所以在最小值和最大值中分别输入0和1。单击Continue按钮,返回主界面。:..…按钮,指定输出的描述统计量和判别函数系数。选中FunctionCoefficients栏中的Fisher’s和Unstandardized。单击Continue按钮,返回主界面。…按钮,定义判别分组参数和选择输出结果。选择Display栏中的Casewiseresults,以输出一个判别结果表。其余的均保留系统默认选项。单击Continue按钮。,单击OK按钮,运行判别分析过程。1)用费希尔判别法建立判别函数和判别规则:未标准化的典型判别函数系数由于可以将实测的样品观测值直接代入求出判别得分,所以该系数使用起来比标准化的系数要方便一些。。,Fisher判别函数为:Y??????????,再比较它们与各类重心的距离,就可以得知分类,如若与group0的重心距离较近则属于group0,反之亦然。。,由于此题中假设各类出现的先验概率相等且误判造成的损失也相等,所以距离判别法与bayes判别完全一致。,group栏中的每一列表示样品判入相应列的Bayes判别函数系数。由此可得,各类的Bayes判别函数如下:G0????????????????????:..,得到两个函数值。比较这两个函数值,哪个函数值比较大就可以判断该样品该判入哪一类。2)在判别结果的CasewiseStastics表中容易查到该客户属于group0,信用好。、萎缩性胃炎患者和非胃炎患者中分别抽取五个病人进行四项生化指标的化验:血清铜蛋白?X?、蓝色反应?X?、尿吲哚乙酸?X?和中性硫化物?X?,数据见1234下表。试用距离判别法建立判别函数,并根据此判别函数对原样本进行回判。类别病人序号XXXX1234**********胃22451341040癌32001671227患者417015078510016720146225125714胃7130100612萎炎缩815011776患性者9120133102610160100510**********非1217012564胃炎1316514253患**********者1510011772解:令胃癌患者、萎缩性胃炎患者和非胃炎患者分别为group1、group2、group3,由于此题中假设各类出现的先验概率相等且误判造成的损失也相等,所以距离判别法与bayes判别完全一致。用spss的解题步骤如下:→Classify→Discriminate,调出判别分析主界面,将左边的变量:..列表中的“group”变量选入分组变量中,将X、X、XX变量选入自变量中,并选择Enter123、4independentstogether单选按钮,即使用所有自变量进行判别分析。,定义分组变量的取值范围。本例中分类变量的范围为1到3,所以在最小值和最大值中分别输入1和3。单击Continue按钮,返回主界面。…按钮,指定输出的描述统计量和判别函数系数。选中FunctionCoefficients栏中的Fisher’s:给出Bayes判别函数的系数。…按钮,弹出classification子对话框,选中Display选项栏中的Summarytable复选框,即要求输出错判矩阵,以便实现题中对原样本进行回判的要求。,单击OK按钮,运行判别分析过程。根据判别分析的结果建立Bayes判别函数:。表中每一列表示样本判入相应类的Bayes判别函数系数。由此可建立判别函数如下:Group1:Y1??????:Y2??????:Y3??????,得到三个函数值。比较这三个函数值,哪个函数值比较大就可以判断该样品判入哪一类。,。从中可以看出在5个胃癌患者中,有4个被正确地判定,有1个被错误地判定为非胃炎患者,正确率为80%。在5个萎缩性胃炎患者中,有4个被正确判定,有1个被错误地判定为非胃炎患者,正确率为80%。在5个非胃炎患者中,有4个被正确判定,有1个被错误地判为萎缩性胃炎患者。%。

应用多元统计分析习题解答 朱建平 第四章 来自淘豆网www.taodocs.com转载请标明出处.

相关文档 更多>>
非法内容举报中心
文档信息
  • 页数13
  • 收藏数0 收藏
  • 顶次数0
  • 上传人小屁孩
  • 文件大小746 KB
  • 时间2024-04-15