1 / 4
文档名称:

统计分析方法学习总结.doc

格式:doc   大小:78KB   页数:4页
下载后只包含 1 个 DOC 格式的文档,没有任何的图纸或源代码,查看文件列表

如果您已付费下载过本站文档,您可以点这里二次下载

分享

预览

统计分析方法学习总结.doc

上传人:小博士 2018/10/13 文件大小:78 KB

下载得到文件列表

统计分析方法学习总结.doc

文档介绍

文档介绍::..统计分析方法学****总结S201505158陈丹妮一、 统计的描述一般采用以下几种图形描述数据:直方图:表示几个变量的数据,使人们能够看出这些数目的大体分布或“形状”;盒形图:比直方图简单一些的是盒形图(boxplot,又称箱图、箱线图、盒子图);茎叶阁:既展示了数据的分布形状又有原始数据。它象一片带有茎的叶子。茎为较大位数的数字,叶为较小位数的数字;散点图:描述的数据有两对连续变量;定型变量的图:定性变量(或属性变量,分类变量)不能点出直方图、散点图或茎叶图,但可以描绘出它们各类的比例,如:饼图、条形图。二、 汇总统计量表示位置的汇总统H•量:均值(mean):样本值的算术平均值;中位数(median):中间大小的数(一半样本点小于中位数);(第一或第三}(下、上)四分位数(点){firstquantile,thirdquantile)(分别有1/4或3/4的数目小于它们);k-百分位数(k-percentile);a分位数(acentile):k-百分位数=k%分位数:有k%的数目小于它;众数(mode):样木屮出现最多的数。表示尺度的汇总统计S:极差(range):极端值之差;四分位间距(四分位极差)(interquantilerange)四分位数之差;标准差(standarddeviation)方差平方根;方差(variance)各点到均值距离平方的平均。三、 相关的分布相关的分布包括:离散分布、连续分布、抽样分布:我们能够利用样本统计麓中的(描述样本的)信息,比如样本均值和样本标准差中的信息,来对(描述总体的)总体参数(比如总体均值和总体标准差)进行推断(佔计、检验等)。大数定律:阐述大量随机变量的平均结果具有稳定性的一系列定律的总称。其中又分为独立同分布大数定律(提供了用样本平均数估计总体平均数的理论依据)和贝努力大数定律(提供了频率代替概率的理论依据)。中心极限定理:阐述大量随机变量之和的极限分布是正态分布的一系列定理的总称。独立同分布屮心极限定理(不论总体服从何种分布,只要它的数学期望和方差存在,从屮抽収容量为n的样本,当n充分大时,则这个样本的总和或平均数是服从正态分布的随机变量)和德莫佛一拉普拉斯屮心极限定理(提供了用正态分布近似计算二项分布概率的方法)。均值的假设检验包括对于正态总体均值的检验、对于比例的检验四、 ,称为水平,比如收入有三个水平,观点有两个水平,性别有两个水平等。列联表的中间各个变量不同水平的交汇处,就是这种水平组合出现的频数或计数(count)。二维的列联表又称为交叉表(crosstable)0列联表可以有很多维。维数多的叫做岛维列联表。注意前而这个列联表的变y:都是定性变从;但列联表也会带有定量变量作为协变量。(analysisofvariance,ANOVA)是分析各个自变量对因变量影响的一种方法。这里的自变量就是定性变量的因子及可能出现的称为协变量(covahate)的定:U:变馑。分析结果是由一个方差分析表表示的。原理为:把因变呈的值随着自变量的不同取值而得到的变化进行分解,使得每一个自变量都有一份贡献,最后剩下无法用已知的