聚类分析方法应用举例

合集下载
  1. 1、下载文档前请自行甄别文档内容的完整性,平台不提供额外的编辑、内容补充、找答案等附加服务。
  2. 2、"仅部分预览"的文档,不可在线预览部分如存在完整性等问题,可反馈申请退款(可完整预览的文档不适用该条件!)。
  3. 3、如文档侵犯您的权益,请联系客服反馈,我们会尽快为您处理(人工客服工作时间:9:00-18:30)。

刘向民物流工程 S11085240007

聚类分析方法应用举例

多元统计,是研究多个随机变量之间相互依赖关系以及内在统计规律性的一门统计学科。多元统计所包括的内容很多.但在实际统计分析中,聚类分析是应用最广泛的方法之一。聚类分析(cluste:Analysis),是研究分类问题的一种多元统计分析方法社会经济统计的分类问题,过去在传统方法上,主要是结合一定的专业知识进行定性分类处理。由于定性分类主要是靠经验完成,因而其结论难免带有较多的主观性和随意性,故不能很好地揭示客观事物内在的本质差别和联系。而聚类分析能带来定量上的分析可以解决这个问题,下面通过一些实例来描述聚类分析方法在应用上的体现;

1 基于聚类分析的安徽省物流需求研究

选取了分行业统计的年产值类指标构建物流需求指标体系(X组),具体指标包括:农业总产值(万元)(X1)、工业总产值(亿元)(X2)、建筑业总产值(万元)(X3)、社会消费零售总额(万元)(X4)、亿元商品市场成交额(万元)(X5)、进出口总额(万美元)(X6)。该指标体系通过农业、工业、建筑业、批发业、零售业及国际贸易的发生额较全面地反映了地区的物流需求情况。

2 研究方法

分类问题一般的解决法是聚类分析或者因子分析基础上的聚类分析。由于本文最终期望得安徽省地级市物流需求分类情况,无需了解各个指标体系的内在系统结构,故选择聚类分析方法更简明。进行聚类分析时,本文采用的是基于样本聚类的Q型系统聚类方法。

3研究过程和结果

3.1地区物流需求指标的聚类分析

由分析软件输出的聚类过程统计量如表1所示。可以看出,伪F统计量在归为4类及7类

时较大,说明归为4类及7类时较好;伪T2统计量在1类、2类、3类时较大,由于伪T2大说明上一次归类效果较好,所以归为4类、3类、2类效果较好。而R2的值在由4类归为3类、由3类归为2类以及由2类归为1类时都有较大的减小,说明归类为2类、3类和4类都是比较好的。半偏R2统计量的值越大,则上一步聚类效果更好,所以归为4类、3 类、2类效果都较好。综合考虑四个统计量的值,并考虑分类的实用性,本文认为归为4类比较合适。聚类图见图1。

由软件分析得的聚类过程得到每一类的各个指标的平均值如表2所示。可以看出,四类地区的区分明显,各种产值指标依次递减。依据四类地区物流需求情况可将安徽省的17个地级市分为物流需求旺盛的省会经济圈、需求较大的马铜芜地区;物流需求量小的两淮和皖南山物流需求量小的两淮和皖南山区以及物流需求较小的第三类地区。

2 聚类分析在证券投资基本分析中的应用

有相关数据,聚类分析与结论;

应用SPSS软件对31支股票进行系统聚类分析,由聚类分析的结果将这31支股票大致可以分成6类:第1类:合金投资(18)、四川双马(19),第2类:厦新电子(3)、数源科技(22)、清华同方(1)、皖维高新(15)、哈药集团(14);第3类:乐凯胶片(11)、中原油气(29)、辽河油田(21)、盐田港(23);第4类:王府井(9)、深信泰丰(17)、上海机场(13)、中集集团(24)、西山煤电(26)、中兴通讯(28)、神火股份(30);第5类:波导股份(10)、鞍钢新轧(25)、伊利股份(4)、宝钢股份(12)、燕京啤酒(2)、隆平高科(27);第6类:方正科技(6)、长安汽车(31)、太极集团(5)、青岛啤酒(16)、深康佳(20)、东软股份(7)、中国联通(8)。

3 我国区域可持续发展的聚类分析应用举例1 可持续发展指标体系

2 聚类分析的基本步骤相关公式定理

3 具体应用

应用spss软件,以31个省市、自治区作为样本,部分数据见表1。以各区域的生存支持系统、发展支持系统、环境支持系统、社会支持系统和智力支持系统为指标进行聚类分析。.应用SPSS软件可以得到聚类分析谱系图,如图2。根据树状图,当距离取6时,可将我国各地区的可持续发展水平分为4类,并应用线性加权求平均值法。把4类分别求总指标平均值见表2;

相关文档
最新文档