-201-第十章数据的统计描述和分析数理统计研究的对象是受随机因素影响的数据,以下数理统计就简称统计,统计是以概率论为基础的一门应用学科。数据样本少则几个,多则成千上万,人们希望能用少数几个包含其最多相关信息的数值来体现数据样本总体的规律。描述性统计就是搜集、整理、加工和分析统计数据,使之系统化、条理化,以显示出数据资料的趋势、特征和数量关系。它是统计推断的基础,实用性较强,在统计工作中经常使用。面对一批数据如何进行描述与分析,需要掌握参数估计和假设检验这两个数理统计的最基本方法。我们将用Matlab的统计工具箱(StatisticsToolbox)来实现数据的统计描述和分析。§1统计的基本概念1.1总体和样本总体是人们研究对象的全体,又称母体,如工厂一天生产的全部产品(按合格品及废品分类),学校全体学生的身高。总体中的每一个基本单位称为个体,个体的特征用一个变量(如x)来表示,如一件产品是合格品记0=x,是废品记1=x;一个身高170(cm)的学生记170=x。从总体中随机产生的若干个个体的集合称为样本,或子样,如n件产品,100名学生的身高,或者一根轴直径的10次测量。实际上这就是从总体中随机取得的一批数据,不妨记作nxxx,,,21L,n称为样本容量。简单地说,统计的任务是由样本推断总体。1.2频数表和直方图一组数据(样本)往往是杂乱无章的,做出它的频数表和直方图,可以看作是对这组数据的一个初步整理和直观描述。将数据的取值范围划分为若干个区间,然后统计这组数据在每个区间中出现的次数,称为频数,由此得到一个频数表。以数据的取值为横坐标,频数为纵坐标,画出一个阶梯形的图,称为直方图,或频数分布图。若样本容量不大,能够手工做出频数表和直方图,当样本容量较大时则可以借助Matlab这样的软件了。让我们以下面的例子为例,介绍频数表和直方图的作法。例1学生的身高和体重学校随机抽取100名学生,测量他们的身高和体重,所得数据如表表1身高体重数据身高体重身高体重身高体重身高体重身高体重1727516955169641716516747171621686716552169621686516662168651645917058165641605517567173741726416857155571766417269169581765717358168501695216772170571665516149173571757615851170631696317361164591656216753171611667016663172531736017864163571695416966178601776617056167541695817373170581606517962172501634717367165581766316252-202-165661725917766182691757517060170621696318677...