第2章数据的表述课件.ppt
《第2章数据的表述课件.ppt》由会员分享,可在线阅读,更多相关《第2章数据的表述课件.ppt(127页珍藏版)》请在三一办公上搜索。
1、第二章 数据的表述,一、数据的分类 二、数据的整理三、数据的概括性度量指标,主要内容,目录,一、数据的分类,(一)数据分类的原则,互斥原则:每一个数据只能划归到某一类型中,而不能既是这一类,又是那一类 。,穷尽原则:所有被观察的数据都可被归属到适当的类型中,没有一个数据无从归属。,(二)数据的类型,1. 定性数据和定量数据,定性数据:用文字描述的 。如消费者对国美所提供服务的总体评价等都属于文字描述的定性数据。,定量数据:用数字描述的。如企业的净资产额、净利润额等。,2. 离散型数据和连续型数据,类型,离散型变量:数据只能取整数。如一家公司的职工人数。,连续型变量的数据可以取介于两个数值之间的
2、任意数值。如销售额、经济增长率等。,3. 数据的四个等级,定类数据,例如,对人口按性别划分为男性和女性两类。,也称列名数据(分类数据),这种数据只对事物的某种属性和类别进行具体的定性描述。,能够进行的唯一运算是计数,即计算每一个类型的频数或频率(即比重)。,定序数据,例如,对企业按经营管理的水平和取得的效益划分为一级企业、二级企业等。,定序数据,也称顺序数据,是对事物所具有的属性顺序进行描述。,定距数据,如10、20等。它不仅有明确的高低之分,而且可以计算差距,如20比10高10,比5高15等。,也称间距数据,是比定序数据的描述功能更好一些的定量数据。,定距测定的量可以进行加或减的运算,但却不
3、能进行乘或除的运算。,定比数据,如产量、产值、固定资产投资额、居民货币收入和支出、银行存款余额等。,也称比率数据,是比定距数据更高一级的定量数据。它不仅可以进行加减运算,而且还可以作乘除运算。,测定层次,特征,运算功能,举例,1. 定类测定2. 定序测定3. 定距测定4. 定比测定,分类分类;排序分类;排序;有基本测量单位分类;排序;有基本测量单位;有绝对零点,计数计数;排序计数;排序;加减计数;排序;加减乘除,产业分类企业等级温度商品销售额,统计数据四个层次的概括,知音漫客问卷大调查,Q1.看完知音漫客第五集的感觉是什么? 1.非常有趣 2.有点有趣 3.一般 4.有点无趣 5.非常无趣Q2
4、.你的性别是? 1.女 2.男Q3.你的年龄是? _ 岁Q4.平均每月购买几本杂志? _本,气温是什么数据?出生地呢?柔道的段位?体重?,二、 统计数据的整理,统计搜集到的大量资料是分散的,不系统的,只能说明各个单位的特征和属性,必须按照科学的原则加以整理,使之条理化和系统化,成为便于储存和传递的、反映总体特征的数据。,基本问题,要弄清所面对的数据类型不同类型的数据,采取不同的处理方式和方法对分类数据和顺序数据主要是作分类整理对数值型数据则主要是作分组整理适合于低层次数据的整理和显示方法也适合于高层次的数据;但适合于高层次数据的整理和显示方法并不适合于低层次的数据,分类数据的整理与图示,定类数
5、据的整理(基本过程),1.列出各类别,3. 制作频数分布表4. 用图形显示数据,定类数据的整理(可计算的统计量),SPSS中的频数分布表频数(Frequency):变量值落在某个区间(或某个类别)中的次数。百分比(Percent):各频数占总样本数的百分比。有效百分比(Valid Percent):各频数占有效样本数的百分比。,定类数据整理频数分布表 (例题分析),【例】一家市场调查公司为研究不同品牌饮料的市场占有率,对随机抽取的一家超市进行了调查。调查员在某天对50名顾客购买饮料的品牌进行了记录,如果一个顾客购买某一品牌的饮料,就将这一饮料的品牌名字记录一次 。右边就是记录的原始数据,使用E
6、xcel计数函数 (COUNTIF),如果只需要计算某一类别的数据个数,可以使用Excel中的统计函数【COUNTIF】。在对话框【Range】后输入数据区域,在【Criteria】后输入数字、表达式、字符串等,计数单元格必须符合的条件,即可得出结果 例如,我们要计算出可口可乐出现的频数,在【Range】后输入A1:A50(数据所在的区域),在【Criteria】后输入“可口可乐”,结果为15。如果数据区域是数值型数据,计算符合特定条件的数据个数,则可在【Criteria】后输入“某一数值”、“某一数值”、“=某一数值”,等等,统计函数COUNTIF,分类数据的图示条形图(bar chart)
7、,用宽度相同的条形的高度或长短来表示各类别数据的图形有单式条形图、复式条形图等形式主要用于反映分类数据的频数分布绘制时,各类别可以放在纵轴,称为条形图,也可以放在横轴,称为柱形图(column chart),分类数据的图示条形图 (例题分析),分类数据的图示帕雷托图(Pareto chart),按各类别数据出现的频数多少排序后绘制的柱形图 主要用于展示分类数据的分布,分类数据的图示对比条形图(side-by-side bar chart ),分类变量在不同时间或不同空间上有多个取值对比分类变量的取值在不同时间或不同空间上的差异或变化趋势,分类数据的图示对比条形图 (例题分析),分类数据的图示饼
8、图(pie chart),也称圆形图,是用圆形及圆内扇形的角度来表示数值大小的图形主要用于表示样本或总体中各组成部分所占的比例,用于研究结构性问题绘制圆形图时,样本或总体中各部分所占的百分比用圆内的各个扇形角度表示,这些扇形的中心角度,按各部分数据百分比占3600的相应比例确定,分类数据的图示饼图 (例题分析),顺序数据的整理(可计算的统计量),1. 累积频数(cumulative frequencies):各类别频数的逐级累加2. 累积频率(cumulative percentages):各类别频率(百分比)的逐级累加,顺序数据的频数分布表(例题分析),【例】在一项城市住房问题的研究中,研究
9、人员在甲乙两个城市各抽样调查300户,其中的一个问题是:“您对您家庭目前的住房状况是否满意?” 1非常不满意;2不满意;3一般;4满意;5非常满意。,顺序数据的频数分布表 (例题分析),顺序数据的图示累计频数分布图 (例题分析),甲城市家庭对住房状况评价的累积频数分布,环形图(doughnut chart),环形图中间有一个“空洞”,样本或总体中的每一部分数据用环中的一段表示与饼图类似,但又有区别饼图只能显示一个总体各部分所占的比例环形图则可以同时绘制多个样本或总体的数据系列,每一个样本或总体的数据系列为一个环用于结构比较研究 用于展示分类和顺序数据,环形图 (例题分析),数值型数据的整理与展
10、示,数据分组,分组方法,分组方法,单变量值分组(要点),1. 将一个变量值作为一组2. 适合于离散变量3. 适合于变量值较少的情况,组距分组 (要点),将变量值的一个区间作为一组适合于连续变量适合于变量值较多的情况需要遵循“不重不漏”的原则可采用等距分组,也可采用不等距分组,组距分组(步骤),确定组数:组数的确定应以能够显示数据的分布特征和规律为目的。在实际分组时,组数一般为5K 15,可以按 Sturges 提出的经验公式确定组数K,确定组距:组距(class width)是一个组的上限与下限之差,可根据全部数据的最大值和最小值及所分的组数来确定,即 组距( 最大值 - 最小值) 组数,统计
11、出各组的频数并整理成频数分布表,组距分组(几个概念),1. 下限(low limit) :一个组的最小值2. 上限(upper limit) :一个组的最大值3. 组距(class width) :上限与下限之差4. 组中值(class midpoint) :下限与上限之间的中点值,频数分布表的编制(例题分析),【例】表中是某电脑公司2005年前四个月各天的销售量数据(单位:台)。试对数据进行分组,频数分布表的编制(步骤),确定组数:根据 Sturges 提出的经验公式得组数K为,确定各组的组距 组距( 237 - 141) 10=9.6 10,用Excel制作频数分布表,等距分组表(上下组限
12、重叠),等距分组表(上下组限间断),等距分组表(使用开口组),使用Excel频数函数 (FREQUENCY),Excel的【直方图】工具的缺陷是:频数分布及直方图没有与数据链接,当改变任何一个数据时,频数分布表和直方图不会跟着改变使用统计函数【FREQUENCY】创建频数分布表和直方图可解决这一问题。具体步骤是选择与接受区域相临近的单元格区域,作为频数分布表输出的区域选择统计函数中的【FREQUENCY】函数在对话框【Date-array】后输入数据区域,在【Bins-array】后输入接受区域同时按下“Ctrl-Shift-Enter”组合键,即得到频数分布,统计函数FREQUENCY,数值
13、型数据的图示,分组数据直方图和折线图,分组数据直方图(histogram),用于展示分组数据分布的一种图形用矩形的宽度和高度来表示频数分布本质上是用矩形的面积来表示频数分布在直角坐标系中,用横轴表示数据分组,纵轴表示频数或频率,各组与相应的频数就形成了一个矩形,即直方图直方图下的总面积等于1,分组数据的图示(直方图的绘制),某电脑公司销售量分布的直方图,我一眼就看出来了,销售量在170180之间的天数最多!,销售量(台),分组数据直方图(直方图与条形图的区别),条形图是用条形的长度(横置时)表示各类别频数的多少,其宽度(表示类别)则是固定的直方图是用面积表示各组频数的多少,矩形的高度表示每一组
14、的频数或百分比,宽度则表示各组的组距,其高度与宽度均有意义直方图的各矩形通常是连续排列,条形图则是分开排列条形图主要用于展示分类数据,直方图则主要用于展示数值型数据,分组数据折线图(frequency polygon),折线图也称频数多边形图是在直方图的基础上,把直方图顶部的中点(组中值)用直线连接起来,再把原来的直方图抹掉折线图的两个终点要与横轴相交,具体的做法是第一个矩形的顶部中点通过竖边中点(即该组频数一半的位置)连接到横轴,最后一个矩形顶部中点与其竖边中点连接到横轴折线图下所围成的面积与直方图的面积相等,二者所表示的频数分布一致,分组数据的图示(折线图的绘制),折线图与直方图下的面积相
15、等!,140,150,210,某电脑公司销售量分布的折线图,190,200,180,160,170,220,230,240,销售量(台),未分组数据茎叶图(stem-and-leaf display),用于显示未分组的原始数据的分布由“茎”和“叶”两部分构成,其图形是由数字组成的以该组数据的高位数值作树茎,低位数字作树叶树叶上只保留最后一位数字对于n(20 n 300)个数据,茎叶图最大行数不超过 L = 10 lg n ,未分组数据茎叶图(例题分析),某电脑公司销售量分布的茎叶图,茎叶图与直方图的区别,茎叶图类似于横置的直方图,但又有区别直方图可观察一组数据的分布状况,但没有给出具体的数值茎
16、叶图既能给出数据的分布状况,又能给出每一个原始数值,保留了原始数据的信息直方图适用于大批量数据,茎叶图适用于小批量数据,随时间起舞的图线图(line plot),表示时间序列数据趋势的图形时间一般绘在横轴,数据绘在纵轴图形的长宽比例大致为10 : 74. 一般情况下,纵轴数据下端应从“0”开始,以便于比较。数据与“0”之间的间距过大时,可以采取折断的符号将纵轴折断,(例题分析),【例】我国19912003年城乡居民家庭的人均收入数据如右表。试绘制线图,(例题分析),留意象形图,右图是象形图,象形图其实就是柱状图,以图形取代柱体。这个图的目标是广告商,他们正在考虑预算要花在什么地方。这个图显示,
17、时代杂志吸引了大量的广告支出。真是这样的吗?笔顶端的数字显示 在时代杂志的广告费是新闻周刊的1.64倍。,注意刻度,改变线图的刻度所产生的效果:两个图所展示的是同一组数据,但是右边的图使得增加的速度看起来快得多。,怎样把图画好,一定要在表示与说明里表示清楚,图里面变量是什么,单位是什么,以及资料来源。要让数据很醒目。要确实注意到,抓住看图者注意力的是数据本身,而不是标示,格子,或者背景。你是在画一个呈现数据的图,而不是在搞艺术创作。要注意实际上眼睛会捕捉到什么。避免用象形图,而且要注意刻度。也不要用很炫目的“三维空间”效果,因为那只会让人看得迷迷糊糊,不会增加看的人对数据的了解。,蹩脚的图,右
- 配套讲稿:
如PPT文件的首页显示word图标,表示该PPT已包含配套word讲稿。双击word图标可打开word文档。
- 特殊限制:
部分文档作品中含有的国旗、国徽等图片,仅作为作品整体效果示例展示,禁止商用。设计者仅对作品中独创性部分享有著作权。
- 关 键 词:
- 数据 表述 课件

链接地址:https://www.31ppt.com/p-1824164.html