文档库 最新最全的文档下载
当前位置:文档库 › 统计学第三版课后习题答案 高等教育出版社

统计学第三版课后习题答案 高等教育出版社

统计学第三版课后习题答案 高等教育出版社
统计学第三版课后习题答案 高等教育出版社

附录1:各章练习题答案第1章绪论(略)

第2章统计数据的描述

2.1 (1)属于顺序数据。

(2)频数分布表如下:

服务质量等级评价的频数分布服务质量等

级家庭数(频率)

频率%

A 14 14

B 21 21

C 32 32

D 18 18

E 15 15

合计100 100

(3)条形图(略)

2.2 (1)频数分布表如下:

40个企业按产品销售收入分组表

按销售收入分组(万

元)

企业数(个)频率(%)

先进企业

良好企业一般企业落后企业11

9

9

27.5

22.5

22.5

合计40 100.0 2.3 频数分布表如下:

某百货公司日商品销售额分组表按销售额分组(万

元)

频数(天)频率(%)

25~30 30~35 35~40 40~45 45~50

4

6

15

9

6

10.0

15.0

37.5

22.5

15.0

合计40 100.0 直方图(略)。

2.4 (1)排序略。

(2)频数分布表如下:

100只灯泡使用寿命非频数分布

按使用寿命分组(小

时)灯泡个数

(只)

频率(%)

650~660 2 2

660~670 5 5

670~680 6 6

680~690 14 14

690~700 26 26

700~710 18 18

710~720 13 13

720~730 10 10

730~740 3 3

740~750 3 3

合计

直方图(略)。

(3)茎叶图如下:

(2)分组结果如下:

分组天数(天)

-25~-20 6

-20~-15 8

-15~-10 10

-10~-5 13

-5~0 12

0~5 4

5~10 7

合计60

(3)直方图(略)。

2.6 (1)直方图(略)。

(2)自学考试人员年龄的分布为右偏。

2.7 (

A班分散,

且平均成绩较A班低。

2.8

2.9 (1)x =274.1(万元);Me=272.5 ;Q L =260.25;Q U =291.25。 (2)17.21=s (万元)。

2.10 (1)甲企业平均成本=19.41(元),乙企业平均成本=18.29(元);原因:尽管两个企业的单位成本相同,但单位成本较低的产品在乙企业的产量中所占比重较大,因此拉低了总平均成本。

2.11 x =426.67(万元);48.116=s (万元)。

2.12 (1)(2)两位调查人员所得到的平均身高和标准差应该差不多相同,因为均值和标准差的大小基本上不受样本大小的影响。

(3)具有较大样本的调查人员有更大的机会取到最高或最低者,因为样本越大,变化的范围就可能越大。

2.13 (1)女生的体重差异大,因为女生其中的离散系数为0.1大于男生体重的离散系数0.08。

(2) 男生:x =27.27(磅),27.2=s (磅); 女生:x =22.73(磅),27.2=s (磅); (3)68%; (4)95%。

2.14 (1)离散系数,因为它消除了不同组数据水平高地的影响。 (2)成年组身高的离散系数:024

.01.1722.4==s

v ;

幼儿组身高的离散系数:032

.03

.713.2==

s

v

由于幼儿组身高的离散系数大于成年组身高的离散系数,说明幼儿组身高的离散程度相对较大。

2.15 下表给出了一些主要描述统计量,请读者自己分析。

2.16 2.17 (略)。

第3章 概率与概率分布

3.1设A =女性,B =工程师,AB =女工程师,A+B =女性或工程师 (1)P(A)=4/12=1/3 (2)P(B)=4/12=1/3

(3)P(AB)=2/12=1/6

(4)P(A+B)=P(A)+P(B)-P(AB)=1/3+1/3-1/6=1/2

3.2求这种零件的次品率,等于计算“任取一个零件为次品”(记为A )的概率()P A 。 考虑逆事件A =“任取一个零件为正品”,表示通过三道工序都合格。据题意,有:

()(10.2)(10.1)(10.1)0.648P A =---=

于是 ()1()10.6480.352P A P A =-=-=

3.3设A 表示“合格”,B 表示“优秀”。由于B =AB ,于是

)|()()(A B P A P B P ==0.8×0.15=0.12

3.4 设A =第1发命中。B =命中碟靶。求命中概率是一个全概率的计算问题。再利用对立事件的概率即可求得脱靶的概率。

)|()()|()()(A B P A P A B P A P B P +=

=0.8×1+0.2×0.5=0.9 脱靶的概率=1-0.9=0.1

或(解法二):P (脱靶)=P (第1次脱靶)×P(第2次脱靶)=0.2×0.5=0.1 3.5 设A =活到55岁,B =活到70岁。所求概率为:

()()0.63(|)0.75()

()

0.84

P AB P B P B A P A P A =

===

3.6这是一个计算后验概率的问题。

设A =优质率达95%,A =优质率为80%,B =试验所生产的5件全部优质。 P(A)=0.4,P (A )=0.6,P (B|A )=0.955, P(B |A )=0.85,所求概率为:

6115

.050612

.030951.0)

|()()|()()

|()()|(===

A B P A P A B P A P A B P A P B A P +

决策者会倾向于采用新的生产管理流程。

3.7 令A 1、A 2、A 3分别代表从甲、乙、丙企业采购产品,B 表示次品。由题意得:P (A 1)=0.25,P (A 2)=0.30, P (A 3)=0.45;P (B |A 1)=0.04,P (B |A 2)=0.05,P (B |A 3)=0.03;因此,所求概率分别为:

(1))|()()|()()|()()(332211A B P A P A B P A P A B P A P B P ++=

=0.25×0.04+0.30×0.05+0.45×0.03=0.0385 (2)3506

.00385

.00135.00.03

0.450.050.300.040.2503

.045.0)|(3==++=

????B A P

3.8据题意,在每个路口遇到红灯的概率是p =24/(24+36)=0.4。

设途中遇到红灯的次数=X ,因此,X ~B(3,0.4)。其概率分布如下表:

(次) 3.9 设被保险人死亡数=X ,X ~B (20000,0.0005)。

(1)收入=20000×50(元)=100万元。要获利至少50万元,则赔付保险金额应该不超过50万元,等价于被保险人死亡数不超过10人。所求概率为:P(X ≤10)=0.58304。 (2)当被保险人死亡数超过20人时,保险公司就要亏本。所求概率为: P(X >20)=1-P(X ≤20)=1-0.99842=0.00158 (3)支付保险金额的均值=50000×E (X ) =50000×20000×0.0005(元)=50(万元) 支付保险金额的标准差=50000×σ(X )

=50000×(20000×0.0005×0.9995)1/2=158074(元)

3.10 (1)可以。当n 很大而p 很小时,二项分布可以利用泊松分布来近似计算。本例中,λ= np =20000×0.0005=10,即有X ~P (10)。计算结果与二项分布所得结果几乎完全一致。 (2)也可以。尽管p 很小,但由于n 非常大,np 和np(1-p)都大于5,二项分布也可以利用正态分布来近似计算。

本例中,np=20000×0.0005=10,np(1-p)=20000×0.0005×(1-0.0005)=9.995, 即有X ~N (10,9.995)。相应的概率为: P (X ≤10.5)=0.51995,P(X ≤20.5)=0.853262。

可见误差比较大(这是由于P 太小,二项分布偏斜太严重)。

【注】由于二项分布是离散型分布,而正态分布是连续性分布,所以,用正态分布来近似计算二项分布的概率时,通常在二项分布的变量值基础上加减0.5作为正态分布对应的区间点,这就是所谓的“连续性校正”。

(3)由于p =0.0005,假如n =5000,则np =2.5<5,二项分布呈明显的偏态,用正态分布来计算就会出现非常大的误差。此时宜用泊松分布去近似。 3.11(1))6667.1()30

200

150()150(-<-<

=

P ==0.04779

合格率为1-0.04779=0.95221或95.221%。

(2) 设所求值为K ,满足电池寿命在200±K 小时范围内的概率不小于0.9,即有:

|200|

(|200|){||}0.9

30

30X K P X K P Z --<=<≥=

即:{}0.95

30

K P Z

<

≥,K /30≥1.64485,故K ≥49.3456。

3.12设X =同一时刻需用咨询服务的商品种数,由题意有X ~B(6,0.2)

(1)X 的最可能值为:X 0=[(n+1)p]=[7×0.2]=1 (取整数) (2)∑=--

=≤-=>2

668

.02

.01)2(1)2(k k

k

k C X P X

P

=1-0.9011=0.0989

第4章 抽样与抽样分布

4.1 a. 20, 2 b. 近似正态 c. -2.25 d. 1.50

4.2 a. 0.0228 b. 0.0668 c. 0.0062 d. 0.8185 e. 0.0013 4.3 a. 0.8944 b. 0.0228 c. 0.1292 d. 0.9699 4.4 a. 101, 99 b. 1 c. 不必 4.5 趋向正态

4.6. a. 正态分布, 213, 4.5918 b. 0.5, 0.031, 0.938

4.7. a. 406, 1.68, 正态分布 b. 0.001 c. 是,因为小概率出现了 4.8. a. 增加 b. 减少

4.9. a. 正态 b. 约等于0 c. 不正常 d. 正态, 0.06 4.10 a. 0.015 b. 0.0026 c. 0.1587

4.11. a. (0.012, 0.028) b. 0.6553, 0.7278 4.12. a. 0.05 b. 1 c. 0.000625

第5章 参数估计

5.1 (1)79.0=x σ。(2)E =1.55。

5.2 (1)14.2=x σ。(2)E =4.2。(3)(115.8,124.2)。 5.3 (2.88,3.76);(2.80,3.84);(2.63,4.01)。 5.4 (7.1,12.9)。 5.5 (7.18,11.57)。

5.6 (18.11%,27.89%);(17.17%,22.835)。 5.7 (1)(51.37%,7

6.63%);(2)36。 5.8 (1.86,1

7.74);(0.19,19.41)。

5.9 (1)2±1.176;(2)2±3.986;(3)2±3.986;(4)2±3.587;(5)2±3.364。 5.10 (1)75.1=d ,63.2=d s ;(2)1.75±4.27。 5.11 (1)10%±

6.98%;(2)10%±8.32%。 5.12 (4.06,14.35)。 5.13 48。 5.14 139。 5.15 57。 5.16 769。 第6章 假设检验

6.1 研究者想要寻找证据予以支持的假设是“新型弦线的平均抗拉强度相对于以前提高了”,所以原假设与备择假设应为:1035:0≤μH ,1035:1>μH 。

6.2 π=“某一品种的小鸡因为同类相残而导致的死亡率”,04.0:0≥πH ,04.0:1<πH 。 6.3 65:0=μH ,65:1≠μH 。

6.4 (1)第一类错误是该供应商提供的这批炸土豆片的平均重量的确大于等于60克,但

检验结果却提供证据支持店方倾向于认为其重量少于60克;

(2)第二类错误是该供应商提供的这批炸土豆片的平均重量其实少于60克,但检验结果却没有提供足够的证据支持店方发现这一点,从而拒收这批产品; (3)连锁店的顾客们自然看重第二类错误,而供应商更看重第一类错误。 6.5 (1)检验统计量n

s x z /

μ-=

,在大样本情形下近似服从标准正态分布;

(2)如果05.0z z >,就拒绝0H ;

(3)检验统计量z =2.94>1.645,所以应该拒绝0H 。 6.6 z =3.11,拒绝0H 。 6.7 z =1.93,不拒绝0H 。 6.8 z =7.48,拒绝0H 。 6.9 2χ=206.22,拒绝0H 。 6.10 z =-5.145,拒绝0H 。 6.11 t =1.36,不拒绝0H 。 6.12 z =-4.05,拒绝0H 。 6.13 F =8.28,拒绝0H 。 6.14 (1)检验结果如下: t-检验: 双样本等方差假设

变量 1 变量 2 平均 100.7 109.9 方差 24.11578947 33.35789474 观测值 20 20 合并方差 28.73684211 假设平均差 0 df 38 t Stat -5.427106029 P(T<=t) 单尾 1.73712E-06 t 单尾临界 1.685953066 P(T<=t) 双尾 3.47424E-06 t 双尾临界 2.024394234

t-检验: 双样本异方差假设

变量 1 变量 2 平均 100.7 109.9 方差 24.11578947 33.35789474 观测值 20 20 假设平均差 0 df 37 t Stat -5.427106029 P(T<=t) 单尾 1.87355E-06

t 单尾临界 1.687094482 P(T<=t) 双尾 3.74709E-06 t 双尾临界 2.026190487 (2)方差检验结果如下: F-检验 双样本方差分析

变量 1 变量 2 平均 100.7 109.9 方差 24.11578947 33.35789474 观测值 20 20 df 19 19 F 0.722940991 P(F<=f) 单尾 0.243109655 F 单尾临界 0.395811384

第7章 方差分析与试验设计 7.1 0215

.86574.401.0=<=F F (或01.00409.0=>=-αvalue P ),不能拒绝原假设。

7.2

8853.30684.1705.0=>=F F (或05.00003.0=<=-αvalue P ),拒绝原假设。 85.54.14304.44=>=-=-LSD x x B A ,拒绝原假设;

85.58.16.424.44=<=-=-LSD x x C A ,不能拒绝原假设; 85.56.126.4230=>=-=-LSD x x C B ,拒绝原假设。

7.3

554131.3478.105.0=<=F F 05.0245946.0=>=-αvalue P

7.4 有5种不同品种的种子和4种不同的施肥方案,在20快同样面积的土地上,分别

采用5种种子和4种施肥方案搭配进行试验,取得的收获量数据如下表: 2592.32397.705.0=>=F F 种子(或05.00033.0=<=-αvalue P ),拒绝原假设。 4903.32047.905.0=<=F F 施肥方案(或05.00019.0=<=-αvalue P ),拒绝原假设。

7.5 9443.60727.005.0=<=F F 地区(或05.09311.0=>=-αvalue P ),不能拒绝原假设。

9443.61273.305.0=<=F F 包装方法(或05.01522.0=>=-αvalue P ),不能拒绝原假设。 7.6 1432.575.1005.0=>=F F 广告方案(或05.00104.0=<=-αvalue P ),拒绝原假设。

9874.5305

.0=<=F F 广告媒体

(或05.01340.0=>=-αvalue P ),不能拒绝原假设。 1432.575.105

.0=<=F F 交互作用

(或05.02519.0=>=-αvalue P ),不能拒绝原假设。

第8章 相关与回归分析

8.1(1)利用Excel 计算结果可知,相关系数为 0.948138XY r =,说明相关程度较高。

(2)计算t 统计量

2.6817398.4368510.317859

t =

=

=

=

给定显著性水平=0.05,查t 分布表得自由度n-2=10-2=8的临界值t α为2.306,

显然2

t t α>,表明相关系数 r 在统计上是显著的。 8.2 利用Excel 中的”数据分析”计算各省市人均GDP 和第一产业中就业比例的相关系数为:-0.34239,这说明人均GDP 与第一产业中就业比例是负相关,但相关系数只有-0.34239,表明二者负相关程度并不大。 相关系数检验:

在总体相关系数0=ρ

的原假设下,计算t 统计量:

0.34239 1.9624t -?=

=

=-

查t 分布表,自由度为31-2=29,当显著性水平取05.0=α时,2

αt =2.045;当显著性水平取0.1α=时,2

αt =1.699。

由于计算的t 统计量的绝对值1.9624小于2αt =2.045,所以在05.0=α的显著性水平下,不能拒绝相关系数0=ρ的原假设。即是说,在05.0=α的显著性水平下不能认为人均GDP 与第一产业中就业比例有显著的线性相关性。

但是计算的t 统计量的绝对值1.9624大于2

αt =1.699,所以在0.1α=的显著性水平下,可以拒绝相关系数0=ρ的原假设。即在0.1α=的显著性水平下,可以认为人均GDP 与第一产业中就业比例有一定的线性相关性。 8.3 设当年红利为Y ,每股帐面价值为X 建立回归方程 12i i i Y X u ββ=++

估计参数为 ^

0.4797750.072876i

i

Y X =+

参数的经济意义是每股帐面价值增加1元时,当年红利将平均增加0.072876元。 序号6的公司每股帐面价值为19.25元,增加1元后为20.25元,当年红利可能为:

^0.4797750.07287620.25 1.955514i

Y =+?=(元)

8.4 (1)数据散点图如下:

(2)根据散点图可以看出,随着航班正点率的提高,投诉率呈现出下降的趋势,两者之间存在着一定的负相关关系。

(3)设投诉率为Y ,航班正点率为X

建立回归方程 12i i i Y X u ββ=++ 估计参数为 ^ 6.01780.07i

i

Y X =-

(4)参数的经济意义是航班正点率每提高一个百分点,相应的投诉率(次/10万名乘客)下降0.07。

(5)航班按时到达的正点率为80%,估计每10万名乘客投诉的次数可能为:

4187.08007.00178.6?=?-=i

Y (次/10万) 8.5 由Excel 回归输出的结果可以看出: (1)回归结果为

^

23332.993090.0716190.1687270.179042i

i

i

i

Y X X X =+++ (2)由Excel 的计算结果已知:1234,,,ββββ 对应的 t 统计量分别为0.51206、4.853871、4.222811、3.663731 ,其绝对值均大于临界值0.025(224) 2.101t -= ,所以各个自变量都对Y 有明显影响。

由F=58.20479, 大于临界值0.05(41,224) 3.16F --=,说明模型在整体上是显著的。

8.6 (1)该回归分析中样本容量是14+1=15 (2)计算RSS=66042-65965=77

ESS 的自由度为k-1=2,RSS 的自由度 n-k=15-3=12 (3)计算:可决系数 2

65965/660420.9988R ==

修正的可决系数

2

1511(10.9988)0.9986

153

R -=-

?-=-

(4)检验X2和X3对Y 是否有显著影响

/(1)65965/2329825140.11/()

77/12

6.4166

ESS k F RSS n k -=

=

==-

(5) F 统计量远比F 临界值大,说明X2和X3联合起来对Y 有显著影响,但并不能

确定X2和X3各自对Y 的贡献为多少。

8.7

8.8 (1)用Excel Y 和X 数据,2X 和3X 的数

用Y 对X 、2

X 、3

X 回归,估计参数

^

2

3

1726.737.8796468740.00895 3.7124906i i Y X X

E X

=-+-+-

t=(-1.9213) (2.462897) (-2.55934) (3.118062) 20.973669R = 20.963764R =

(2)检验参数的显著性:当取0.05α=时,查t 分布表得0.025(124) 2.306t -=,与t 统计量对比,除了截距项外,各回归系数对应的t 统计量的绝对值均大于临界值,表明在这样的显著性水平下,回归系数显著不为0。

(3)检验整个回归方程的显著性:模型的20.973669R =,20.963794R =,说明可决系数较高,对样本数据拟合较好。由于F=98.60668,而当取0.05α=时,查F 分布表得0.05(41,124) 4.07F --=,因为F=98.60668>4.07,应拒绝0234:0H βββ===,说明X 、2X 、3

X 联合起来对Y 确有显著影响。

(4)计算总成本对产量的非线性相关系数:因为20.973669R =因此总成本对产量的非线性相关系数为20.973669R =或R=0.9867466

(5)评价:虽然经t 检验各个系数均是显著的,但与临界值都十分接近,说明t 检验只是勉强通过,其把握并不大。如果取0.01α=,则查t 分布表得0.005(124) 3.3554t -=,这时各个参数对应的t 统计量的绝对值均小于临界值,则在0.01α=的显著性水平下都应接受0

:0j

H β=的原假设。

8.9 利用Excel 输入X 、y 和Y 数据,用Y 对X 回归,估计参数结果为

i

i x Y 314.073.5?-= t 值=(9.46)(-6.515) 794.02=R 775.02=R

整理后得到:x e y

314.09693.307?-?= 第9章 时间序列分析

9.1 (1)30× 31.06×21.05= 30×1.3131 = 39.393(万辆) (2)117.11%==

(3)设按7.4%的增长速度n 年可翻一番 则有 1.07460/302n ==

所以 n = log2 / log1.074 = 9.71(年)

故能提前0.29年达到翻一番的预定目标。

9.2 (1)(1)以1987年为基期,2003年与1987年相比该地区社会商品零售额共增长:

%86.2313186.213186.31%)8.61(%)2.81(%)101(555==-=-+?+?+ (2)年平均增长速度为

1%)8.61(%)2.81(%)101(15

555-+?+?+=0.0833=8.33% (3) 2004年的社会商品零售额应为

509.52)0833.01(307

=+?(亿元)

9.3 (1)发展总速度%12.259%)81(%)101(%)121(343=+?+?+ 平均增长速度=%9892.91%12.25910=- (2)8.561%)61(5002=+?(亿元) (3)平均数∑===

=4

1

5.1424

5704

1

j j y y

(亿元),

2002年一季度的计划任务:625.1495.142%105=?(亿元)。

9.4 (1)用每股收益与年份序号回归得^

0.3650.193t Y t =+。预测下一年(第11年)的每股收

益为488.211193.0365.0?11

=?+=Y 元

(2)时间数列数据表明该公司股票收益逐年增加,趋势方程也表明平均每年增长0.193元。是一个较为适合的投资方向。

9.5 (1)移动平均法消除季节变动计算表

(2)t T t ?+=63995.09625.8?(3)趋势剔出法季节比例计算表(一)

t T t ?+=63995.09625.8趋势剔出法季节比例计算表(二)

KL t t t S T Y -?=2004年第一季度预测值:

7723.21097301.1)1763995.09625.8(???1

1717=??+=?=S T Y 2004年第二季度预测值:

49725.23147237.1)1863995.09625.8(???2

1818=??+=?=S T Y 2004年第三季度预测值:

009.18852641.0)1963995.09625.8(???3

1919=??+=?=S T Y 2004年第四季度预测值:

6468.19902822.0)2063995.09625.8(???4

2020=??+=?=S T Y

平均法计算季节比率表:

(2)

9.7

(1)采用线性趋势方程法:t T i 0065.70607.460?+= 剔除其长期趋势。

趋势分析法剔除长期趋势表:

剔除长期趋势后分析其季节变动情况表:

(3)运用分解法可得到循环因素如下图:

第10章 统计指数 10.1 %

73.1072.20398.2196 , %16.1042.2039212400010001==∑∑===∑∑=q p q p L p q p q L p q ;

%

39.1072124

2281 , %83.1038

.219622811

0111

011==

∑∑=

==

∑∑=

q p q p P p q p q P p q 。

10.2

%

99.1034236

44058.21962.20392281

2124==++=

q E ;%

99.103%83.103%16.104=?=q

F

%

00.1042

%

83.103%16.104=+=

q B 。

10.3 %27.93125550

117100 , %83.92101800945001

0111

011==

∑∑='==

∑∑=p q p q P z q z q P q q 。

10.4 %

73.1072

.20398.21960

000==

∑∑=

q p q p i A p p ;%

39.1072124

22811111==

∑∑=

p

p

i q p q p H

;%

01.1070

00

=∏=

∑q p q p p p

i G

10.5

V

P L p q =?;%86.111%39.107%16.104=? ;8

.241157

8.84=+。

10.6 ⑴2.43%12360=?;⑵0.24%67.6360 , %67.106%105%112=?=÷;

⑶2.19%5%67.106360=??;⑷2.432.190.24 , %112%105%67.106=+=?。 10.7 ⑴3483.220904908 , 6967.220905636 , 3816.2196046681

======假定

x x x ⑵3816.26967

.23483.26967.23816.23483.2=

?,%23.113%84.114%60.98=?

3816

.26967

.21960209046685636?=

%23.113%63.106%74.120?= , 6.6586.309968+≈

10.8 依据有关公式列表计算各企业的工业经济效益综合指数如下:

各企业经济效益综合指数一览表(标准比值法)

10.9

各企业经济效益综合指数一览表(改进的功效系数法)

社会统计学复习题(有答案)

社会统计学课程期末复习题 一、填空题(计算结果一般保留两位小数) 1、第五次人口普查南京市和上海市的人口总数之比为 比较 相对指标;某企业男女职工人数之比为 比例 相对指标;某产品的废品率为 结构 相对指标;某地区福利机构网点密度为 强度 相对指标。 2、各变量值与其算术平均数离差之和为 零 ;各变量值与其算术平均数离差的平方和为 最小值 。 3、在回归分析中,各实际观测值y 与估计值y ?的离差平方和称为 剩余 变差。 4、平均增长速度= 平均发展速度 —1(或100%)。 5、 正J 形 反J 形 曲线的特征是变量值分布的次数随变量值的增大而逐步增多; 曲线的特征是变量值分布的次数随变量值的增大而逐步减少。 6、调查宝钢、鞍钢等几家主要钢铁企业来了解我国钢铁生产的基本情况,这种调查方式属于 重点 调查。 7、要了解某市大学多媒体教学设备情况,则总体是 该市大学中的全部多媒体教学设备 ;总体单位是 该市大学中的每一套多媒体教学设备; 。 8、若某厂计划规定A 产品单位成本较上年降低6%,实际降低了7%,则A 产品单位成本计划超额完成程度为 100%7% A 100% 1.06%100%6% -=-=-产品单位成本计划超额完成程度 ;若某厂计划规定B 产品产量较上年增长5%,实际增长了10%,则B 产品产量计划超额完成程度为 100%10% 100% 4.76%100%5% +=-=+B 产品产量计划超额完成程度 。 9、按照标志表现划分,学生的民族、性别、籍贯属于 品质 标志;学生的体重、年龄、成绩属于 数量 标志。 10、从内容上看,统计表由 主词 和 宾词 两个部分组成;从格式上看,统计表由 总标题 、 横行标题 、 纵栏标题 和 指标数值(或统计数值); 四个部分组成。 11、从变量间的变化方向来看,企业广告费支出与销售额的相关关系,单位产品成本与单位产品原材料消耗量的相关关系属于 正 相关;而市场价格与消费者需求数量的相关关系,单位产品成本与产品产量的相关关系属于 负 相关。 12、按指标所反映的数量性质不同划分,国民生产总值属于 数量 指标;单位成本属于 质量 指标。 13、如果相关系数r=0,则表明两个变量之间 不存在线性相关关系 。 二、判断题

贾平俊统计学第五版课后思考题答案(完整版)

统计学(第五版)贾俊平课后思考题答案(完整版) 第一章思考题 1.1什么是统计学 统计学是关于数据的一门学科,它收集,处理,分析,解释来自各个领域的数据 并从中得出结论。 1.2解释描述统计和推断统计 描述统计;它研究的是数据收集,处理,汇总,图表描述,概括与分析等统计方法。 推断统计;它是研究如何利用样本数据来推断总体特征的统计方法。 1.3统计学的类型和不同类型的特点 统计数据;按所采用的计量尺度不同分; (定性数据)分类数据:只能归于某一类别的非数字型数据,它是对事物进行分 类的结果,数据表现为类别,用文字来表述; (定性数据)顺序数据:只能归于某一有序类别的非数字型数据。它也是有类别的,但这些类别是有序的。 (定量数据)数值型数据:按数字尺度测量的观察值,其结果表现为具体的数 值。 统计数据;按统计数据都收集方法分;

观测数据:是通过调查或观测而收集到的数据,这类数据是在没有对事物人为控制的条件下得到的。 实验数据:在实验中控制实验对象而收集到的数据。 统计数据;按被描述的现象与实践的关系分; 截面数据:在相同或相似的时间点收集到的数据,也叫静态数据。 时间序列数据:按时间顺序收集到的,用于描述现象随时间变化的情况,也叫动态数据。1.4解释分类数据,顺序数据和数值型数据 答案同1.3 1.5举例说明总体,样本,参数,统计量,变量这几个概念 对一千灯泡进行寿命测试,那么这千个灯泡就是总体,从中抽取一百个进行检测,这一百个灯泡的集合就是样本,这一千个灯泡的寿命的平均值和标准差还有合格率等描述特征的数值就是参数,这一百个灯泡的寿命的平均值和标准差还有合格率等描述特征的数值就是统计量,变量就是说明现象某种特征的概念,比如说灯泡的寿命。 1.6变量的分类 变量可以分为分类变量,顺序变量,数值型变量。 变量也可以分为随机变量和非随机变量。经验变量和理论变量。 1.7举例说明离散型变量和连续性变量 离散型变量,只能取有限个值,取值以整数位断开,比如"企业数"

统计学第三章课后作业题

第三章作业: 甲单位工人水平: 1120260320 1.5 200 xf x f ?+?+?= =∑∑甲 =(件/人) 乙单位工人水平 3012030 1.83012030123 x x m x ++==++∑∑乙= (件/人) 可以看出乙单位工人水平较高。 ( 2 )哪个单位工人的生产水平整齐? 甲单位生产水平的方差: 2 2 2()1 1.51200.45 200 i i i x x f f σ --+= ∑∑甲 ()……== 同样计算乙单位生产水平的方差: 2 2()0.36 i i i x x f f σ -= ∑∑乙 = 很明显乙单位的方差较小。 2 、某企业 2010 年某种产品单位成本为 800 元, 2011 年计划规定比 2010 年下降 8% ,实际下降 6% 。 企业 2011 年产品销售量计划为上年的 108% , 2011 年销售量动态相对指标为 114% ,试计算: ( 1 )该种产品 2011 年单位成本计划与实际的数值; 2011年单位成本计划数值为:800*(100%-8%)=736元 2011年单位成本实际数值为:800*(100%-6%)=752元 ( 2 ) 2011 年单位产品成本计划完成程度; 成本计划完成程度:752/736=1.0217=102.17% ( 3 ) 2011 年产品销售计划完成程度。 销售计划完成程度:1.14/1.08=1.0556=105.56%

甲市场平均价格: ()375 .1 4 5.5 / = = ∑ ∑ = x m m X (元/斤) 乙市场平均价格: 325 .1 4 3.5 = = ∑ ∑ = f xf X (元/斤) 说明:两个市场销售单价是相同的,销售总量也是相同的,但甲市场平均收购价高于乙市场,是因为甲市场低价格收购量所占比重(25%)小于乙市场(50%)4 、某厂甲、乙两个工人班组,每班组有8 名工人,每个班组每个工人的月生产量记录如下: 甲班组:20 、40 、60 、70 、80 、100 、120 、70 乙班组:67 、68 、69 、70 、71 、72 、73 、70 要求:(1 )计算甲乙两组工人平均月产量; 甲班组:平均每人产量: 件 70 = ∑ = n x x 乙班组:平均每人产量: 件 70 = ∑ = n x x (2 )计算甲乙两组的全距、标准差、标准差系数; 甲班组:全距: 件 100 20 120 min max = - = - =x x R 标准差: () 件 6. 29 8 7000 2 = = - ∑ = n x x σ 标准差系数: % 29 . 42 70 6. 29 = = = x V σ σ 乙班组:全距: 件 6 67 73 min max = - = - =x x R 标准差: () 件 5.3 8 28 2 = = - ∑ = n x x σ 标准差系数: % 00 .5 70 5.3 = = = x V σ σ

统计学(第三版课后习题答案

Hah 和网速是无形的 1:各章练习题答案 2.1 (1)属于顺序数据。 (2)频数分布表如下: 服务质量等级评价的频数分布 服务质量等级家庭数(频率)频率% A1414 B2121 C3232 D1818 E1515 合计100100 (3)条形图(略) 2.2 (1)频数分布表如下: 40个企业按产品销售收入分组表 按销售收入分组(万元)企业数 (个) 频率 (%) 向上累积向下累积 企业数频率企业数频率 100以下100~110 110~120 120~130 130~140 140以上 5 9 12 7 4 3 12.5 22.5 30.0 17.5 10.0 7.5 5 14 26 33 37 40 12.5 35.0 65.0 82.5 92.5 100.0 40 35 26 14 7 3 100.0 87.5 65.0 35.0 17.5 7.5 合计40 100.0 ————(2)某管理局下属40个企分组表 按销售收入分组(万元)企业数(个)频率(%) 先进企业良好企业一般企业落后企业11 11 9 9 27.5 27.5 22.5 22.5 合计40 100.0

2.3 频数分布表如下: 某百货公司日商品销售额分组表 按销售额分组(万元)频数(天)频率(%) 25~30 30~35 35~40 40~45 45~50 4 6 15 9 6 10.0 15.0 37.5 22.5 15.0 合计40 100.0 直方图(略)。 2.4 (1)排序略。 (2)频数分布表如下: 100只灯泡使用寿命非频数分布 按使用寿命分组(小时)灯泡个数(只)频率(%) 650~660 2 2 660~670 5 5 670~680 6 6 680~690 14 14 690~700 26 26 700~710 18 18 710~720 13 13 720~730 10 10 730~740 3 3 740~750 3 3 合计100 100 直方图(略)。 (3)茎叶图如下: 65 1 8 66 1 4 5 6 8 67 1 3 4 6 7 9 68 1 1 2 3 3 3 4 5 5 5 8 8 9 9 69 0 0 1 1 1 1 2 2 2 3 3 4 4 5 5 6 6 6 7 7 8 8 8 8 9 9 70 0 0 1 1 2 2 3 4 5 6 6 6 7 7 8 8 8 9 71 0 0 2 2 3 3 5 6 7 7 8 8 9 72 0 1 2 2 5 6 7 8 9 9 73 3 5 6 74 1 4 7

心理和教育统计学课后题答案解析

张厚粲现代心理与教育统计学第一章答案 1名词概念 (1 )随机变量 答:在统计学上把取值之前,不能准确预料取到什么值的变量,称为随机变量。 (2)总体 答:总体(population )又称为母全体或全域,是具有某种特征的一类事物的总体,是研究对象的全体。 (3)样本 答:样本是从总体中抽取的一部分个体。 (4)个体 答:构成总体的每个基本单元。 (5)次数 是指某一事件在某一类别中出现的数目,又称作频数,用f表示。 (6)频率 答:又称相对次数,即某一事件发生的次数除以总的事件数目,通常用比例或百分数来表示。 (7)概率 答:概率(probability), 概率论术语,指随机事件发生的可能性大小度量指标。其描述性定义。随机事件A在所有试验中发生的可能性大小的量值,称为事件A的概率,记为P(A)。 (8)统计量 答:样本的特征值叫做统计量,又称作特征值。 (9)参数 答:又称总体参数,是描述一个总体情况的统计指标。 (10)观测值 答:随机变量的取值,一个随机变量可以有多个观测值。 2何谓心理与教育统计学?学习它有何意义? 答:(1)心理与教育统计学是专门研究如何运用统计学原理和方法,搜集、整理、分析心理 与教育科学研究中获得的随机性数据资料,并根据这些数据资料传递的信息,进行科学推论 找出心理与教育统计活动规律的一门学科。具体讲,就是在心理与教育研究中,通过调查、实验、测量等手段有意地获取一些数据,并将得到的数据按统计学原理和步骤加以整理、计 算、绘制图表、分析、判断、推理,最后得出结论的一种研究方法。 (2)学习心理与教育统计学有重要的意义。 ①统计学为科学研究提供了一种科学方法。 科学是一种知识体系。它的研究对象存在于现实世界各个领域的客观事实之中。它的主 要任务是对客观事实进行预测和分类,从而揭示蕴藏于其中的种种因果关系。要提高对客观 事实观测及分析研究的能力,就必须运用科学的方法。统计学正是提供了这样一种科学方法。统计方法是从事科学研究的一种必不可少的工具。 ②心理与教育统计学是心理与教育科研定量分析的重要工具。 凡是客观存在事物,都有数量的表现。凡是有数量表现的事物,都可以进行测量。心理 与教育现象是一种客观存在的事物,它也有数量的表现。虽然心理与教育测量具有多变性而 且旨起它发生变化的因素很多,难以准确测量。但是它毕竟还是可以测量的。因此,在进行 心理与教育科学研究时,在一定条件下,是可以对心理与教育现象进行定量分析的。心理与 教育统计就是对心理与教育问题进行定量分析的重要的科学工具。 ③广大心理与教育工作者学习心理与教育统计学的具体意义。 a. 可经顺利阅读国内外先进的研究成果。 b. 可以提高心理与教育工作的科学性和效率。

统计学课后习题答案完整版

统计学课后习题答案 HEN system office room 【HEN16H-HENS2AHENS8Q8-HENH1688】

第四章 统计描述 【】某企业生产铝合金钢,计划年产量40万吨,实际年产量45万吨;计划降低成本5%,实际降低成本8%;计划劳动生产率提高8%,实际提高10%。试分别计算产量、成本、劳动生产率的计划完成程度。 【解】产量的计划完成程度=%5.112100%40 45 100%=?=?计划产量实际产量 即产量超额完成%。 成本的计划完成程=84%.96100%5%-18% -1100%-1-1≈?=?计划降低百分比实际降低百分比 即成本超额完成%。 劳动生产率计划完= 85%.101100%8%110% 1100%11≈?++=?++计划提高百分比实际提高百分比 即劳动生产率超额完成%。 【】某煤矿可采储量为200亿吨,计划在1991~1995年五年中开采全部储量的%, 试计算该煤矿原煤开采量五年计划完成程度及提前完成任务的时间。 【解】本题采用累计法: (1)该煤矿原煤开采量五年计划完成=100% ?数 计划期间计划规定累计数 计划期间实际完成累计 = 75%.1261021025357 4 =?? 即:该煤矿原煤开采量的五年计划超额完成%。 (2)将1991年的实际开采量一直加到1995年上半年的实际开采量,结果为2000万吨,此时恰好等于五年的计划开采量,所以可知,提前半年完成计划。 【】我国1991年和1994年工业总产值资料如下表:

要求: (1)计算我国1991年和1994年轻工业总产值占工业总产值的比重,填入表中; (2)1991年、1994年轻工业与重工业之间是什么比例(用系数表示) (3)假如工业总产值1994年计划比1991年增长45%,实际比计划多增长百分之几? 1991年轻工业与重工业之间的比例=96.01.144479 .13800≈; 1994年轻工业与重工业之间的比例=73.04.296826 .21670≈ (3) %37.25 1%) 451(2824851353 ≈-+ 即,94年实际比计划增长%。 【】某乡三个村2000年小麦播种面积与亩产量资料如下表: 要求:(1)填上表中所缺数字; (2)用播种面积作权数,计算三个村小麦平均亩产量; (3)用比重作权数,计算三个村小麦平均亩产量。

统计学第三章课后习题画图作业

3.5.为了确定灯泡的使用寿命(小时),在一批灯泡中随机抽取100只进行测试,所得结果如下: 700716728719685709691684705718 706715712722691708690692707701 708729694681695685706661735665 668710693697674658698666696698 706692691747699682698700710722 694690736689696651673749708727 688689683685702741698713676702 701671718707683717733712683692 693697664681721720677679695691 713699725726704729703696717688 (1)利用计算机对上面的数据进行排序; (2)以组距为10进行等距分组,整理成频数分布表,并绘制直方图; (3)绘制茎叶图,并与直方图作比较。 解:(1)排序:将全部数据复制到Excel中,并移动到同一列,点击:数据→排序→确定,即完成数据排序的工作。 升序后的表为: 651676685691695698704709717727 658677685691695699705710718728 661679685691696699706710718729 664681688692696700706712719729 665681688692696700706712720733 666682689692697701707713721735

668683689693697701707713722736 671683690693698702708715722741 673683690694698702708716725747 674684691694698703708717726749(2)按题目要求,利用已排序的Excel表数据进行分组及统计,得到频数分布表如下: 100只灯泡使用寿命非频数分布 按使用寿命分组(小时)灯泡个数(只)频率(%) 650~66022 660~67055 670~68066 680~6901414 690~7002626 700~7101818 710~7201313 720~7301010 730~74033 740~75033 合计100100 (3)制作直方图:将上表(包含总标题,去掉合计栏)复制到Excel表中,选择全表后,点击:图表向导→柱形图→选择子图表类型→完成。即得到如下的直方图:

统计学课后习题和答案

第一章 1*.下面的列联表是根据一个小城市的居民教育水平(以获得了高中文凭和没有获得高中文凭分类)和就业状况(以全职和非全职分类)所做出 如果原假设即在教育水平和工作状态之间没有联系为真,那么下列哪一个选项表明了获得了高中文凭并且是全职工作的期望值? A. 9252157g B. 9282157g C.528292g D. 655292g E. 9252 82 g 1*. Answer :B Analysis :本题考查二维表中两个变量的独立性,如果原假设独立成立,那么cell “earned at least a high school diploma ”和“ employed full time ”的期望值为: 92829282 (,)()()157157157157 P Earned Employed Total P Earned P Employed Total == = g g g g g g 2*.一次实验中,每一个随机样本中的成人都有他的最喜爱的颜色,下表展示了按年龄分组 的试验结果。 如果对于颜色的偏好是同年龄组相互独立,下列哪一个选项表明了年龄组30到50岁,喜爱 绿色的人数的期望值? A. (99)(108)314 B. (69)(108)314 C. (99)(35)108 D. (35)(108)314 E. (99)(35) 314 2*. Answer :A Analysis :本题考查二维表中两个变量的独立性,如果两个变量独立,那么cell “aged 30 to 50”和“prefer green ”的期望值为: 1089999108 (3050,)(3050)()314314314314 P green Total P P green Total -=-= = g g g g g g 第二章 1*.下面的直方图代表了五种不同的数据集的分布,每个都包含28个整数,从1到7,水平和垂直比例对所有图形都是相同的。下面哪个图代表了有最大标准差的数据集?

教育统计学与SPSS课后作业答案祥解题目

教育统计学课后作业 一、P118 1 题目:10位大一学生平均每周所花的学习时间与他们的期末考试成绩见表6-17.试问: (1)学习时间与考试成绩之间是否相关? (2)比较两组数据谁的差异程度大一些? (3)比较学生2与学生9的期末考试测验成绩。 表6-17 学习时间与期末考试成绩 1 2 3 4 5 6 7 8 9 10 学习时间考试成绩40 58 43 73 18 56 10 47 25 58 33 54 27 45 17 32 30 68 47 69 解题步骤: (1)第一步:定义变量:“xuexishijian”、“xuexichengji”后,输入数据.如下图: 1

第二步:单击选择“分析(Analyze)”中的“相关(Correlate)”中的“双变量(Bivariate Correlations)”, 将上图中的“xuexishijian”和“xuexichengji”添加到右边变量框中,如下图: 第三步:点击“确定“后,输出结果如下图: 第四步:分析结果

3 由上图可知:学习时间与学习成绩之间的pearson 相关系数为0.714,p (双侧)为0.20。自由度 df=10-2=8时,查“皮尔逊积差相关系数显著临界值表”知:r 0.05= 0.623 ; r 0.01=0.765。 因为0.765 > 0.714 >0.623,所以在0.05水平上学习时间和学习成绩是相关显著的。 (2)SPSS 软件分析结果如下图: 由上图可知:学习时间标准差和平均值为:S 1=12.037 ?X 1= 29.00 ;学习时间标准差和平均值为:S 2=12.437?X 2=56.00 根据差异系数公式可知: 学习时间差异系数为:%100?=X S CV S =12.037/29.00×100%=41.51% 学习成绩差异系数为:%100?= X S CV S =12.437/56.00×100%=22.27% 有上述结果可知学习时间差异程度大于学习成绩差异程度。 (4) 把学生2和学生9的期末考试成绩转化成标准分数: Z 2=(X -?X) /S= (73—56)/12.437=1.367 Z 9=(X-?X)/S=(68—56)/12.437=0.965 由上计算可知:学生2期末考试测验成绩优于学生9的期末考试测验成绩。 二、P119 2 题目:某班数学的平均成绩为90,标准差10;化学的平均分为85,标准差为8;物理的平均分为79,标准差为15.某生这三科成绩分别为95,80,80.试问 (1) 该生在哪一学科上突出一些? (2) 该班三科成绩的差异度如何?有无学习分化现象? (3) 该生的学期分数是多少? (4) 三科的总平均和总标准差是多少? 解题步骤:

社会统计学习题和答案--相关与回归分析报告

第十二章 相关与回归分析 第一节 变量之间的相关关系 相关程度与方向·因果关系与对称关系 第二节 定类变量的相关 双变量交互分类(列联表)·削减误差比例(PRE )·λ系数与τ系数 第三节 定序变量的相关分析 同序对、异序对和同分对·Gamma 系数·肯德尔等级相关系数(τa 系数、τb 与τc 系数)·萨默斯系数(d 系数)·斯皮尔曼等级相关(ρ相关)·肯德尔和谐系数 第四节 定距变量的相关分析 相关表和相关图·积差系数的导出和计算·积差系数的性质 第五节 回归分析 线性回归·积差系数的PRE 性质·相关指数R 第六节 曲线相关与回归 可线性化的非线性函数·实例分析(二次曲线指数曲线) 一、填空 1.对于表现为因果关系的相关关系来说,自变量一般都是确定性变量,依变量则一般是( 随机性 )变量。 2.变量间的相关程度,可以用不知Y 与X 有关系时预测Y 的全部误差E 1,减去知道Y 与X 有关系时预测Y 的联系误差E 2,再将其化为比例来度量,这就是( 削减误差比例 )。 3.依据数理统计原理,在样本容量较大的情况下,可以作出以下两个假定:(1)实际观察值Y 围绕每个估计值c Y 是服从( );(2)分布中围绕每个可能的c Y 值的( )是相同的。 4.在数量上表现为现象依存关系的两个变量,通常称为自变量和因变量。自变量是作为( 变化根据 )的变量,因变量是随( 自变量 )的变化而发生相应变化的变量。 5.根据资料,分析现象之间是否存在相关关系,其表现形式或类型如何,并对具有相关关系的现象之间数量变化的议案关系进行测定,即建立一个相关的数学表达式,称为( 回归方程 ),并据以进行估计和预测。这种分析方法,通常又称为( 回归分析 )。 6.积差系数r 是( 协方差 )与X 和Y 的标准差的乘积之比。 二、单项选择 1.当x 按一定数额增加时,y 也近似地按一定数额随之增加,那么可以说x 与y 之间 存在( A )关系。 A 直线正相关 B 直线负相关 C 曲线正相关 D 曲线负相关

统计学课后习题答案第三章 综合指标

第三章综合指标 一、单项选择题 1.总量指标得数值大小 A.随总体范围得扩大而增加 B、随总体范围得扩大而减少 C、随总体范围得减少而增加 D、与总体范围得大小无关 2.总量指标按其说明得内容不同可以分为 A、时期指标与时点指标 B、标志总量与总体总量 C、实物指标与数量指标 D、数量指标与质量指标 3、总量指标按其反映得时间状态不同可分为 A、时期指标与时点指标 B、标志总量与总体总量 C、实物指标与数量指标 D、数量指标与质量指标 4、下列指标中属于总量指标得就是 A、国民生产总值 B、劳动生产率 C、计划完成程度 D、单位产品成本 5、下列指标中属于时点指标得就是 A、商品销售额 B、商品购进额 C、商品库存额 D、商品流通费用额 6、下列指标中属于时期指标得就是 A、在校学生数 B、毕业生人数 C、人口总数 D、黄金储备量 7、某工业企业得全年产品产量为100万台,年末库存量为5 万台,则它们 A、都就是时期指标 B、前者就是时期指标,后者就是时点指标 C、都就是时点指标 D、前者就是时点指标,后者就是时期指标 8、对不同类产品或商品不能直接加总得总量指标就是 A、实物量指标 B、价值量指标

C、劳动量指标 D、时期指标 9、具有广泛得综合性与概括能力得统计指标就是 A、实物量指标 B、价值量指标 C、劳动量指标 D、综合指标 10、如果我们要研究工业企业职工得情况时,则职工人数与工资总额这两个指标 A.都就是标志总量 B、前者就是标志总量,后者就是总 体总量 C、都就是总体总量 D、前者就是总体总量,后者就是标 志总量 11、以10为对比基础而计算出来得相对数称为 A、成数 B、百分数 C、系数 D、倍数 12、两个数值相比,如果分母得数值比分子得数值大很多时,常用得相对数形式就是 A、成数 B、百分数 C、系数 D、倍数 13、既采用有名数,又采用无名数得相对指标就是 A、结构相对指标 B、比例相对指标 C、比较相对指标 D、强度相对指标 14、总体内部部分数值与部分数值之比就是 A、结构相对指标 B、比例相对指标 C、比较相对指标 D、强度相对指标 15、总体内部部分数值与总体数值之比就是 A、结构相对指标 B、比例相对指标 C、比较相对指标 D、强度相对指标 16、反映同类事物在不同时间状态下对比关系得相对指标就是 A、比较相对指标 B、比例相对指标 C、动态相对指标 D、强度相对指标

统计学课后第一章习题答案.doc

第1章导论 1、某森林公园的一项研究试图确定哪些因素有利于成年松树长到60英尺以上的高度。经估计,森林公园生长着25000颗成年松树,该研究需要从中随机抽取250颗成年松树并丈量它们的高度后进行分析。该研究的总体是() A、250颗成年松树 B、公园中25000颗成年松树 C、所有高于60英尺的成年松树 D、森林公园中所有年龄的松树 2、某森林公园的一项研究试图确定成年松树的高度。该研究需要从中随机抽取250颗成年松树并丈量它们的高度后进行分析。该研究所感兴趣的变量是() A、森林公园中松树的年龄 B、森林公园中松树的数量 C、森林公园中松树的高度 D、森林公园中数目的种类 3、推断统计的主要功能是() A、应用总体的信息描述样本 B、描述样本中包含的信息 C、描述总体中包含的信息 D、应用样本信息描述总体 4、对高中生的一项抽样调查表明,85%的高中生愿意接受大学教育。这一叙述是()的结果 A、定性变量 B、试验 C、描述统计 D、推断统计 5、一名统计学专业的学生为了完成其统计学作业,在图书馆找到一本参考书中包含美国50个州的家庭收入中位数。在该生的作业中,他应该将此数据报告来源于() A、试验 B、实际观察 C、随机抽样 D、已发表的资料

6、某大公司的人力资源部主任需要研究公司雇员的饮食习惯。他注意到,雇员的午饭要么从家里带来,要么在公司餐厅就餐,要么在外面的餐馆就餐。该研究的目的是为了改善公司餐厅的现状。这种数据的收集方式可以认为是() A、观察研究 B、设计的试验 C、随机抽样 D、全面调查 7、下列不属于描述统计问题的是() A、根据样本信息对总体进行的推断 B、感兴趣的总体或样本 C、图、表或其他数据汇总工具 D、了解数据分布特征 8、某大学的一位研究人员希望估计该大学一年级新生在教科书上的花费,为此,他观察了200名新生在教科书上的花费,发现他们每个学期平均在教科书上的花费是250元。该研究人员感兴趣的总体是() A、该大学的所有学生 B、所有的大学生 C、该大学所有的一年级新生 D、样本中的200名新生 9、某大学的一位研究人员希望估计该大学一年级新生在教科书上的花费,为此,他观察了200名新生在教科书上的花费,发现他们每个学期平均在教科书上的花费是250元。该研究人员感兴趣的变量是()A、该大学一年级新生的教科书费用 B、该大学的学生数 C、该大学新生的年龄 D、大学生的生活成本 10、在下列叙述中,关于推断统计的描述是() A、一个饼图描述了某医院治疗过的癌症类型,其中2%是肾癌,19%是乳腺癌; B、.从一个果园中采摘36个橘子,利用这36个橘子的平均重量估计

教育统计学复习题及答案

《教育统计学》复习题及答案一、填空题 1.教育统计学的研究对象是.教育问题。 2.一般情况下,大样本是指样本容量.大于30 的样本。 3.标志是说明总体单位的名称,它有.品质标志和数量标志两种。 4.统计工作的三个基本步骤是:、和。 5.集中量数是反映一组数据的趋势的。 6.“65、66、72、83、89”这组数据的算术平均数是。 7.6位学生的身高分别为:145、135、128、145、140、130厘米,他们的众数是。 8.若某班学生数学成绩的标准差是8分,平均分是80分,其标准差系数是。 9.参数估计的方法有和两种。 10.若两个变量之间的相关系数是负数,则它们之间存在。 11.统计工作与统计资料的关系是和的关系。 12.标准差越大,说明总体平均数的代表性越,标准差越小,说明总体平均数的代表性越。 13.总量指标按其反映的内容不同可以分为和。 二、判断题 1、教育统计学属于应用统计学。()

2、标志是说明总体特征的,指标是说明总体单位特征的。() 3、统计数据的真实性是统计工作的生命() 4、汉族是一个品质标志。() 5、描述一组数据波动情况的量数称为差异量数。() 6、集中量数反映的是一组数据的集中趋势。() 7、在一个总体中,算术平均数、众数、中位数可能相等。() 8、同一总体各组的结构相对指标数值之和不一定等于100%。() 9、不重复抽样误差一定大于重复抽样误差。() 10. 一致性是用样本统计量估计统计参数时最基本的要求。() 三、选择题 1.某班学生的平均年龄为22岁,这里的22岁为( )。 A.指标值 B.标志值 C.变量值 D.数量标志值 2.统计调查中,调查标志的承担者是( )。 A.调查对象 B.调查单位 C.填报单位 D.调查表 3.统计分组的关键是( )。 A.确定组数和组距 B.抓住事物本质 C.选择分组标志和划分各组界限 D.统计表的形式设计 4.下列属于全面调查的有( )。 A.重点调查 B.典型调查 C.抽样调查 D.普查 5.统计抽样调查中,样本的取得遵循的原则是( )。 A.可靠性 B.准确性 C.及时性 D.随机性 6. 在直线回归方程Yc =a+bx中,b表示( )。 增加1个单位,y增加a的数量增加1个单位,x增加b的数量 增加1个单位,x的平均增加量增加1个单位,y的平均增加量 7.下列统计指标中,属于数量指标的有() A、工资总额 B、单位产品成本 C、合格品率 D、人口密度 8.在其他条件不变情况下,重复抽样的抽样极限误差增加1倍,则样本单位数变为( )。 A.原来的2倍 B.原来的4倍 C.原来的1/2倍 D.原来的1/4倍 四、简答题 1.学习教育统计学有哪些意义?

统计学原理第三章习题答案

一. 判断题部分 1 : 对统计资料进行分组的目的就是为了区分各组单位之间质的不同。 (×) 2: 统计分组的关键问题是确定组距和组数。 ( × ) 3: 组中值是根据各组上限和下限计算的平均值,所以它代表了每一组的平 均分配次数。 ( × ) 3 : 分配数列的实质是把总体单位总量按照总体所分的组进行分配。 ( ∨ ) 4: 次数分配数列中的次数,也称为频数。频数的大小反映了它所对应的标 志值在总体中所起的作用程度。 ( ∨ ) 5: 某企业职工按文化程度分组形成的分配数列是一个单项式分配数列。 (×) 6: 连续型变量和离散型变量在进行组距式分组时,均可采用相邻组组距重 叠的方法确定组限。 ( ∨ ) 7: 对资料进行组距式分组,是假定变量值在各组内部的分布是均匀的,所 以这种分组会使资料的真实性受到损害。 ( ∨ ) 8: 任何一个分布都必须满足:各组的频率大于零,各组的频数总和等于 或 100%。( × ) 9: 按数量标志分组形成的分配数列和按品质标志分组形成的分配数列,都 可称为次数分布。 ( ∨ ) 10:按数量标志分组的目的,就是要区分各组在数量上的差异。 ( 11:统计分组以后,掩盖了各组内部各单位的差异,而突出了各组之间单位 的差异。( ∨ ) 12:分组以后,各组的频数越大,则组的标志值对于全体标志水平所起的作第三章 统计资料整理 ×)

用也越大;而各组的频率越大,则组的标志值对全体标志水平所起的作用越 小。( × ) .单项选择题部分 2: 在组距分组时,对于连续型变量,相邻两组的组限( A )。 A 、 必须是重叠的 B 、必须是间断的 C 、可以是重叠的,也可以是间断的 D 、必须取整数 3: 下列分组中属于按 品质标志分组 的是( B )。 A 、学生按考试分数分组 B 、产品按品种分组 C 、企业按计划完成程度分组 D 、家庭按年收入分组 4 : 有一个学生考试成绩为70分,在统计分组中,这个变量值应归入 ( B )。 A 、60---70 分这一组 B 、 70---80 分这一组 C 、60— 70或 70—80两组都可以 D 、作为上限的那一组 5: 某主管局将下属企业先按轻、重工业分类,再按企业规模分组,这样的 分组属于( B )。 A 、简单分组 B 、复合分组 C 、分析分组 D 、结构分组 6: 简单分组和复合分组的区别在于( B )。 A 、选择的分组标志的性质不同 B 、选择的分组标志多少不同 1: 统计整理的关键在( B A 、对调查资料进行审核 C 、对调查资料进行汇总 )。 B 、 对调查资料进行统计分组 D 、编制统计表

统计学第三章课后题及答案解析

第三章 一、单项选择题 1.统计整理的中心工作是() A.对原始资料进行审核B.编制统计表 C.统计汇总问题D.汇总资料的再审核 2.统计汇总要求资料具有() A.及时性B.正确性 C.全面性D.系统性 3.某连续变量分为五组:第一组为40—50,第二组为50—60,第三组为60—70,第四组为70—80,第五组为80以上,依习惯上规定() A.50在第一组,70在第四组B.60在第二组,80在第五组 C.70在第四组,80在第五组D.80在第四组,50在第二组 4.若数量标志的取值有限,且是为数不多的等差数值,宜编制() A.等距式分布数列B.单项式分布数列 C.开口式数列D.异距式数列 5.组距式分布数列多适用于() A.随机变量B.确定型变量 C.连续型变量D.离散型变量 6.向上累计次数表示截止到某一组为止() A.上限以下的累计次数B.下限以上的累计次数 C.各组分布的次数D.各组分布的频率 7.次数分布有朝数量大的一边偏尾,曲线高峰偏向数量小的方向,该分布曲线属于()A.正态分布曲线B.J型分布曲线 C.右偏分布曲线D.左偏分布曲线 8.划分连续变量的组限时,相临组的组限一般要() A.交叉B.不等 C.重叠D.间断 二、多项选择题 1.统计整理的基本内容主要包括() A.统计分组B.逻辑检查 C.数据录入D.统计汇总 E.制表打印 2.影响组距数列分布的要素有() A.组类B.组限 C.组距D.组中值 E.组数据 3.常见的频率分布类型主要有() A.钟型分布B.χ型分布 C.U型分布D.J型分布 E.F型分布 4.根据分组标志不同,分组数列可以分为() A.组距数列B.品质数列 C.单项数列D.变量数列 E.开口数列 5.下列变量一般是钟型分布的有()

教育统计学课后练习参考答案

教育统计学课后练习参考答案 第一章 1、教育统计学,就是应用数理统计学的一般原理和方法,对教育调查和教育实验等途径所获得的数据资料进行整理、分析,并以此为依据,进行科学推断,从而揭示蕴含在教育现象中的客观规律的一门科学。 教育统计学既是统计科学中的一个分支学科,又是教育科学中的一个分支学科,是两种科学相互结合、相互渗透而形成的一门交叉学科。从学科体系来看,教育统计学属于教育科学体系的一个方法论分支;从学科性质来看,教育统计学又属于统计学的一个应用分支。 2、描述统计主要是通过对数据资料进行整理,计算出简单明白的统计量数来描述庞大的资料,以显示其分布特征的统计方法。 推断统计又叫分析统计,它根据统计学的原理和方法,从我们所研究的全体对象(即总体)中,按照等可能性原则采取随机抽样的方法,抽出总体中具有代表性的部分个体组成样本,在样本所提供的数据的基础上,运用概率理论进行分析、论证,在一定可靠程度上对总体的情况进行科学推断的一种统计方法。 3、在自然界或教育研究中,一种事物常存在几种可能出现的情况或获得几种可能的结果,这类现象称为随机现象。 随机现象具的特点: (1)一次条件完全相同的实验有多种可能的结果(这样的实验称为随机实验); (2)在实验之前不能确切知道哪种结果会发生; (3)在相同的条件下可以重复进行这样的实验。 4、总体,也叫做母体或全域,是指具有某种共同特征的个体的总和。 当所研究的总体数量非常大时,可以从总体中抽取其中一部分个体来观测,由此来推断总体的信息,从总体中抽出的这部分个体就称为样本,它是用以表征总体的个体的集合。 通常将样本中样本个数大于或等于30个的样本称为大样本,小于30个的称为小样本。 5、复置抽样指每次抽出的个体经观测后,仍放回原总体,然后再从总体中抽取下一个个体。 6、反映总体特征的量数叫做总体参数,简称参数。反映样本特征的量数叫做样本统计量,简称统计量。 参数是总体的真正数值,是固定的常量,理论上应该通过计算总体中全部个体的数值而获得,但由于总体中个体的数量通常很大,总体参数往往很难获得,在统计分析中一般通过样本的数值来估计。在进行推断统计时,就是根据样本统计量来推断总体相应的参数。 第二章 1、按照数据的来源,可分为计数数据和度量数据;按照数据的取值情况,可分为间断性数据和连续性数据;按照数据的测量水平,可分为称名数据、顺序数据、等距数据和比率数据。 2、数据整理的基本方法包括对数据进行排序、统计分组、绘制统计图表等。 3、表的结构要简洁明了;表的层次要清晰;主谓分明。 4、连续性数据:(2),(3);间断性数据:(1),(4)。 5、略 6、(1)50;(2)75;(3)34;(4)5;(5)45

社会统计学复习题有答案

社会统计学复习题有答 案 集团标准化工作小组 #Q8QGGQT-GX8G08Q8-GNQGJ8-MHHGN#

社会统计学课程期末复习题 一、填空题(计算结果一般保留两位小数) 1、第五次人口普查南京市和上海市的人口总数之比为 比较 相对指标;某企业男女职工人数之比为 比例 相对指标;某产品的废品率为 结构 相对指标;某地区福利机构网点密度为 强度 相对指标。 2、各变量值与其算术平均数离差之和为 零 ;各变量值与其算术平均数离差的平方和为 最小值 。 3、在回归分析中,各实际观测值y 与估计值y ?的离差平方和称为 剩余 变差。 4、平均增长速度= 平均发展速度 —1(或100%)。 5、 正J 形 反J 形 曲线的特征是变量值分布的次数随变量值的增大而逐步增多; 曲线的特征是变量值分布的次数随变量值的增大而逐步减少。 6、调查宝钢、鞍钢等几家主要钢铁企业来了解我国钢铁生产的基本情况,这种调查方式属于 重点 调查。 7、要了解某市大学多媒体教学设备情况,则总体是 该市大学中的全部多媒体教学设备 ;总体单位是 该市大学中的每一套多媒体教学设备; 。 8、若某厂计划规定A 产品单位成本较上年降低6%,实际降低了7%,则A 产品单位成本计划超额完成程度为 100%7% A 100% 1.06%100%6% -=- =-产品单位成本计划超额完成程度 ;若某厂计划规定B 产品产量较上年增长5%,实际增长了10%,则B 产品产量计划超额完成程度为 100%10% 100% 4.76%100%5% += -=+B 产品产量计划超额完成程度 。

9、按照标志表现划分,学生的民族、性别、籍贯属于品质标志;学生的体重、年龄、成绩属于数量标志。 10、从内容上看,统计表由主词和宾词两个部分组成;从格式上看,统计表由 总标题、横行标题、纵栏标题和指标数值(或统计数值); 四个部分组成。 11、从变量间的变化方向来看,企业广告费支出与销售额的相关关系,单位产品成本与单位产品原材料消耗量的相关关系属于正相关;而市场价格与消费者需求数量的相关关系,单位产品成本与产品产量的相关关系属于负相关。 12、按指标所反映的数量性质不同划分,国民生产总值属于数量指标;单位成本属于质量指标。 13、如果相关系数r=0,则表明两个变量之间不存在线性相关关系。 二、判断题 1、在季节变动分析中,若季节比率大于100%,说明现象处在淡季;若季节比率小于100%,说明现象处在旺季。(×;答案提示:在季节变动分析中,若季节比率大于100%,说明现象处在旺季;若季节比率小于100%,说明现象处在淡季。 ) 2、工业产值属于离散变量;设备数量属于连续变量。(×;答案提示:工业产值属于连续变量;设备数量属于离散变量) 3、中位数与众数不容易受到原始数据中极值的影响。(√;) 4、有意识地选择十个具有代表性的城市调查居民消费情况,这种调查方式属于典型调查。(√)

黄良文《统计学》(第2版)笔记和课后习题(含考研真题)详解 第1章 导 论【圣才出品】

第1章导论 1.1复习笔记 一、统计学的对象和方法 1.统计和统计学 (1)统计工作的产生和发展 统计工作就是通过社会调查或科学实验,搜集客观现象的现实数据,用来描述和分析自然、社会、经济、政治、文化现象的变化情况。其产生和发展过程包括: ①适应市场经济的发展以及国家对外扩张的需要,大大拓展了统计的活动范围。 ②设立统计专业机构,促成统计活动专业化、独立化。 ③统计方法的完善,大大提高了统计的认识能力。 ④电子计算技术为统计活动的现代化进程提供了手段。 (2)统计学的产生和发展 最初的统计学是作为国家重大事项的记述。这一学派称为国势学派或记述学派,其创始人是17、18世纪德国的海尔曼·康令(H.Conring,1606—1681)和高特弗洛里特·阿亨瓦尔(G.Achenwall,1719—1772)。 经历18世纪到19世纪中叶,把概率论引入统计学,使统计方法发生了重大的飞跃。其代表人物有法国的拉普拉斯(https://www.wendangku.net/doc/fa15998548.html,place,1749—1827)和比利时统计学家阿道夫·凯特勒(A.Quetelet,1796—1874)。政治算术派是以总体数量比较的方法对社会经济问题进行分析,代表人物有威廉·配第(W.Petty,1623—1687)和约翰·格朗特(J.Graunt,1620—1674)。 此后,应用概率论研究随机现象数量规律的数理统计方法及其在各个领域的应用迅速得

到发展。描述统计学以卡尔·皮尔逊(K.Pearson,1857—1936)为代表,到了20世纪20年代的推断统计学以费歇尔(R.A.Fisher,1880一1962)为创始人。 2.统计学的研究对象 统计学的研究对象是指统计研究所要认识的事物客体。统计对象的特点包括数量性、总体性、单位的变异性的特点。而社会经济统计学的研究对象除了具有上述的数量性、总体性、变异性外还具有社会性。 3.统计学的研究方法 (1)统计的组织系统 ①统计的社会系统 统计活动系统包括统计主体、统计客体和统计宿体三个组成部分。其统计流程图,如图1-1所示。 图1-1统计流程图 ②统计工作系统 统计主体的认识活动,有一个严密的工作系统。这个系统具有明显的层次性和阶段性。 统计工作过程一般分为统计设计、统计资料搜集、统计资料整理、统计资料分析、统计资料提供和管理等阶段。 2.统计研究的方法 (1)大量观察法 大量观察法:统计研究客观现象和过程的规律,是从现象总体上加以考察,就总体中的

相关文档
相关文档 最新文档