1 / 16
文档名称:

数据统计分析模型.ppt

格式:ppt   大小:420KB   页数:16页
下载后只包含 1 个 PPT 格式的文档,没有任何的图纸或源代码,查看文件列表

如果您已付费下载过本站文档,您可以点这里二次下载

分享

预览

数据统计分析模型.ppt

上传人:yuzonghong1 2018/7/29 文件大小:420 KB

下载得到文件列表

数据统计分析模型.ppt

文档介绍

文档介绍:数学建模竞赛培训讲座
数据统计分析模型
参考书
施雨,李耀武编,概率论与数理统计应用,西安交通大学出版社
梅长林,范金成编,数据分析方法,高等教育出版社,
王学民编,应用多元统计分析,上海财经大学出版社
方开泰编,使用多元统计分析,华东师范大学出版社
统计软件
SAS (Statistical Analysis System)
SPSS (Statistical Package for the Social Science)
R
数据统计分析常用模型
方差分析
回归分析
判别分析
聚类分析
主成分分析
相关分析(典型相关分析)
因子分析
列联表分析
时间序列分析
例子
例1:为了比较同一类型的三种不同食谱的营养效果,将19只幼鼠随机地分为三组,每只分为8只、4只、7只,各采用这三种食谱喂养。假定其他条件均保持相同,12周后测得其体重增加量如下表所示,是比较这三种食谱的营养效果是否有显著差异
食谱体重增加量
甲 164 190 203 205 206 214 228 257
乙 185 197 201 231
丙 187 212 215 220 248 265 281
例子
例2:为了研制一种治疗枯草热病的药物,将两种成分(A和B)各按三种不同剂量(低、中、高)混合,将36位自愿受试患者随机分为9组,每组4人服用各种剂量回合下的药物,记录其病情缓解的时间(单位:小时)如下表所示,试分析两种成分及交互作用对病情缓解的时间是否有显著影响。
例子
编号品种萼长x1 萼宽x2 瓣长x3 瓣宽x4
1 50 33 14 2
1 46 34 14 3
………………
2 65 28 46 15
2 62 22 45 15
………………
3 64 28 56 22
………………
150 3 63 33 60 25
例子
例4:2000年全国大学生数学建模竞赛A题 DNA序列分类
 2000年6月,人类基因组计划中DNA全序列草图完成,预计2001年可以完成精确的全序列图,此后人类将拥有一本记录着自身生老病死及遗传进化的全部信息的“天书”。这本大自然写成的“天书”是由4个字符A,T,C,G按一定顺序排成的长约30亿的序列,其中没有“断句”也没有标点符号,除了这4个字符表示4种碱基以外,人们对它包含的“内容”知之甚少,难以读懂。破译这部世界上最巨量信息的“天书”是二十一世纪最重要的任务之一。在这个目标中,研究DNA全序列具有什么结构,由这4个字符排成的看似随机的序列中隐藏着什么规律,又是解读这部天书的基础,是生物信息学(Bioinformatics)最重要的课题之一。
    虽然人类对这部“天书”知之甚少,但也发现了DNA序列中的一些规律性和结构。例如,在全序列中有一些是用于编码蛋白质的序列片段,即由这4个字符组成的64种不同的3字符串,其中大多数用于编码构成蛋白质的20种氨基酸。又例如,在不用于编码蛋白质的序列片段中,A和T的含量特别多些,于是以某些碱基特别丰富作为特征去研究DNA序列的结构也取得了一些结果。此外,利用统计的方法还发现序列的某些片段之间具有相关性,等等。这些发现让人们相信,DNA序列中存在着局部的和全局性的结构,充分发掘序列的结构对理解DNA全序列是十分有意义的。目前在这项研究中最普通的思想是省略序列的某些细节,突出特征,然后将其表示成适当的数学对象。这种被称为粗粒化和模型化的方法往往有助于研究规律性和结构。