当前位置:文档之家› 生物统计学(第3版)杜荣骞_课后习题答案_第一章__统计数据的收集与整理

生物统计学(第3版)杜荣骞_课后习题答案_第一章__统计数据的收集与整理

第一章 统计数据的收集与整理

1.1 算术平均数是怎样计算的?为什么要计算平均数?

答:算数平均数由下式计算:,含义为将全部观测值相加再被观测值的个数

除,所得之商称为算术平均数。计算算数平均数的目的,是用平均数表示样本数据的集中点,

或是说是样本数据的代表。

1.2 既然方差和标准差都是衡量数据变异程度的,有了方差为什么还要计算标准差? 答:标准差的单位与数据的原始单位一致,能更直观地反映数据地离散程度。

1.3 标准差是描述数据变异程度的量,变异系数也是描述数据变异程度的量,两者之间有什么不同?

答:变异系数可以说是用平均数标准化了的标准差。在比较两个平均数不同的样本时所得结果更可靠。

1.4 完整地描述一组数据需要哪几个特征数? 答:平均数、标准差、偏斜度和峭度。

1.5 下表是我国青年男子体重(kg )。由于测量精度的要求,从表面上看像是离散型数据,不要忘记,体重是通过度量得到的,属于连续型数据。根据表中所给出的数据编制频数分布表。

66 69 64 65 64 66 68 65 62 64 69 61 61 68 66 57 66 69 66 65 70 64 58 67 66 66 67 66 66 62 66 66 64 62 62 65 64 65 66 72 60 66 65 61 61 66 67 62 65 65 61 64 62 64 65 62 65 68 68 65 67 68 62 63 70 65 64 65 62 66 62 63 68 65 68 57 67 66 68 63 64

66

68

64

63

60

64

69

65

66

67

67

67

65

67

67

66

68

64

67

59 66 65 63 56 66 63 63 66 67 63 70 67 70 62 64 72 69 67 67 66 68 64 65 71 61 63 61 64 64 67 69 70 66 64 65 64 63 70 64 62 69 70 68 65 63 65 66 64 68 69 65 63 67 63 70 65 68 67 69 66 65 67 66 74 64 69 65 64 65 65 68 67 65 65 66 67 72 65 67 62

67

71

69

65

65

75

62

69

68

68

65

63

66

66

65

62

61

68

65

64 67 66 64 60 61 68 67 63 59 65 60 64 63 69 62 71 69 60 63 59 67 61 68 69 66 64 69 65 68 67 64 64 66 69 73 68 60 60 63 38 62 67 65 65 69 65 67 65 72 66 67 64 61 64 66 63 63 66 66 66 63 65 63 67 68 66 62 63 61 66 61 63 68 65 66 69 64 66 70 69

70

63

64

65

64

67

67

65

66

62

61

65

65

60

63

65

62

66

64

答:首先建立一个外部数据文件,名称和路径为:E:\data\exer1-5e.dat 。所用的SAS 程序和计算结果如下:

proc format; value hfmt

56-57='56-57' 58-59='58-59' 60-61='60-61' 62-63='62-63' 64-65='64-65' 66-67='66-67'

n

y

y n

i i

∑==

1

68-69='68-69' 70-71='70-71' 72-73='72-73' 74-75='74-75'; run;

data weight;

infile 'E:\data\exer1-5e.dat'; input bw @@; run;

proc freq; table bw;

format bw hfmt.; run;

The SAS System

Cumulative Cumulative

BW Frequency Percent Frequency Percent ----------------------------------------------------- 56-57 3 1.0 3 1.0 58-59 4 1.3 7 2.3 60-61 22 7.3 29 9.7 62-63 46 15.3 75 25.0 64-65 83 27.7 158 52.7 66-67 77 25.7 235 78.3 68-69 45 15.0 280 93.3 70-71 13 4.3 293 97.7 72-73 5 1.7 298 99.3 74-75 2 0.7 300 100.0

1.6 将上述我国男青年体重看作一个有限总体,用随机数字表从该总体中随机抽出含量为10的两个样本,分别计算它们的平均数和标准差并进行比较。它们的平均数相等吗?标准差相等吗?能够解释为什么吗?

答:用means 过程计算,两个样本分别称为和,结果见下表:

The SAS System

Variable N Mean Std Dev ---------------------------------------- Y1 10 64.5000000 3.5039660 Y2 10 63.9000000 3.1780497 ----------------------------------------

随机抽出的两个样本,它们的平均数和标准差都不相等。因为样本平均数和标准差都是统计量,统计量有自己的分布,很难得到平均数和标准差都相等的两个样本。

1.7 从一个有限总体中采用非放回式抽样,所得到的样本是简单的随机样本吗?为什么?本课程要求的样本都是随机样本,应当采用哪种抽样方法,才能获得一随机样本?

答:不是简单的随机样本。从一个有限总体中以非放回式抽样方法抽样,在前后两次抽样之间不是相互独立的,后一次的抽样结果与前一次抽样的结果有关联,因此不是随机样本。应采用随机抽样的方法抽取样本,具体说应当采用放回式抽样。

1.8 证明若用

或编码时,前式是否仍然相等?

1y 2y ()()∑∑==±='-='-'n i n

i i i i

i

C y y y y

y y 1

12

2

,

其中C y y i

i =

'i

i Cy y ='

答:(1)令

则 平均数特性之③。

(2) 令

平均数特性之②。

用第二种编码方式编码结果,两式不再相等。

1.9 有一个样本:

,设B 为其中任意一个数值。证明只有当

最小。这是平均数的一个重要特性,在后面讲到一元线型回归时还会用到

该特性。

答:令 , 为求使p 达最小之B ,令

则 。

1.10 检测菌肥的功效,在施有菌肥的土壤中种植小麦,成苗后测量苗高,共100株,数据如下[1]:

10.0 9.3 7.2 9.1 8.5 8.0 10.5 10.6 9.6 10.1 7.0 6.7 9.5 7.8 10.5 7.9 8.1 9.6 7.6 9.4 10.0 7.5 7.2 5.0 7.3 8.7 7.1 6.1 5.2 6.8 10.0 9.9

7.5

4.5 7.6 7.0 9.7 6.2 8.0 6.9 8.3

8.6 10.0

4.8

4.9

7.0

8.3

8.4

7.8

7.5

C y y i i ±='C y y ±='()

()()[]()

∑∑∑===-=±-±='-'n

i i n i i n

i i

y y C y C y y y 1

2

12

12

C y y i

i ='C y

y =

'()()

2

1

2

2

112

C y y

C y C y

y y n

i i

n i i n

i i ∑∑∑===-=

?

?? ??-='-'n y y y ,,,21 y B =时,()

∑=-n

i B y 1

2

()∑-=2B y p ()02

=?-?∑B B y ()y

n y

B B y ===-∑∑02

6.6 10.0 6.5 9.

5 8.5 11.0 9.7 6.

6 10.0 5.0

6.5 8.0 8.4 8.

3 7.

4 7.

4

8.1 7.7 7.5 7.1

7.8 7.6 8.6 6.

0 7.0 6.

4

6.7 6.3 6.4 11.0

10.5 7.8 5.0 8.

0 7.0 7.

4

5.2

6.7 9.0 8.6

4.6 6.9 3.5 6.

2 9.7 6.

4

5.8

6.4 9.3 6.4

编制苗高的频数分布表,绘制频数分布图,并计算出该样本的四个特征数。

答:首先建立一个外部数据文件,名称和路径为:E:\data\exr1-10e.dat。SAS程序及结果如下:

options nodate;

proc format;

value hfmt

3.5-

4.4='3.5-4.4' 4.5-

5.4='4.5-5.4' 5.5-

6.4='5.5-6.4'

6.5-

7.4='6.5-7.4' 7.5-

8.4='7.5-8.4' 8.5-

9.4='8.5-9.4'

9.5-10.4='9.5-10.4' 10.5-11.4='10.5-11.4';

run;

data wheat;

infile 'E:\data\exr1-10e.dat';

input height @@;

run;

proc freq;

table height;

format height hfmt.;

run;

proc capability graphics noprint;

var height;

histogram/vscale=count;

inset mean var skewness kurtosis;

run;

The SAS System

The FREQ Procedure

Cumulative Cumulative

height Frequency Percent Frequency Percent ---------------------------------------------------------------------

3.5-

4.4 1 1.00 1 1.00

4.5-

5.4 9 9.00 10 10.00

5.5-

6.4 11 11.00 21 21.00

6.5-

7.4 23 23.00 44 44.00

7.5-8.4 24 24.00 68 68.00

8.5-9.4 11 11.00 79 79.00

9.5-10.4 15 15.00 94 94.00

10.5-11.4 6 6.00 100 100.00

1.11 北太平洋宽吻海豚羟丁酸脱氢酶(HDBH)数据的接收范围频数表[2]如下:(略作调整)

HDBH数据的接收范围

频数

/(U·L-1)

<214 1

<245.909 1 3

<277.818 2 11

<309.727 3 19

<341.636 4 26

<373.545 5 22

<405.454 5 11

<437.363 6 13

<469.272 7 6

<501.181 8 3

<533.090 9 2

根据上表中的数据作出直方图。

答:以表中第一列所给出的数值为组界,直方图如下:

1.12 灵长类手掌和脚掌可以握物一侧的皮肤表面都有突起的皮肤纹嵴。纹嵴有许多特

征,这些特征在胚胎形成之后是终生不变的。人类手指尖的纹型,大致可以分为弓、箕和斗三种类型。在手指第一节的基部可以找到一个点,从该点纹嵴向三个方向辐射,这个点称为三叉点。弓形纹没有三叉点,箕形纹有一个三叉点,斗形纹有两个三叉点,记录从三叉点到箕或斗中心的纹嵴数目称为纹嵴数(finger ridge count, FRC)。将双手十个指尖的全部箕形纹的纹嵴数和/或斗形纹两个纹嵴数中较大者相加,称为总纹嵴数(total finger ridge count, TFRC)。下表给出了大理白族人群总纹嵴数的频数分布[3]:

TFRC分组中值频数

11~30 20 2

31~50 40 1

51~70 60 8

71~90 80 29

91~110 100 54

111~130 120 63

131~150 140 68

151~170 160 51

171~190 180 18

191~210 200 6

首先判断数据的类型,然后绘出样本频数分布图,计算样本的四个特征数并描述样本分布形态。

答:总纹脊数属计数数据。

计数数据的频数分布图为柱状图,频数分布图如下:

样本特征数(以TFRC的中值计算)SAS程序:

options nodate;

data tfrc;

do i=1 to 10; input y @@;

input n @@;

do j=1 to n;

output;

end;

end;

cards;

20 2

40 1

60 8

80 29

100 54

120 63

140 68

160 51

180 18

200 6

;

run;

proc means mean std skewness kurtosis;

var y;

run;

结果见下表:

The SAS System

Analysis Variable : Y

Mean Std Dev Skewness Kurtosis

------------------------------------------------------

126.5333333 32.8366112 -0.2056527 -0.0325058

------------------------------------------------------从频数分布图可以看出,该分布的众数在第七组,即总纹脊数的中值为140的那一组。分布不对称,平均数略小于众数,有些负偏。偏斜度为-0.2056527,偏斜的程度不是很明显,基本上还可以认为是对称的,峭度几乎为零。

1.13 海南粗榧叶长度的频数分布[4]:

叶长度/mm 中值频数

2.0~2.2 2.1 390

2.2~2.4 2.3 1 434

2.4~2.6 2.5 2 643

2.6~2.8 2.7 3 546

2.8~

3.0 2.9 5 692

3.0~3.2 3.1 5 187

3.2~3.4 3.3 4 333

3.4~3.6 3.5 2 767

3.6~3.8 3.7 1 677

3.8~

4.0 3.9 1 137

nag

4.0~4.2 4.1 667

4.2~4.4 4.3 346

4.4~4.6 4.5 181

绘出频数分布图,并计算偏斜度和峭度。

答:表中第一列所给出的数值为组限,下图为海南粗榧叶长度的频数分布图。

计算偏斜度和峭度的SAS程序和计算结果如下:

options nodate;

data length;

do i=1 to 13; input y @@;

input n @@;

do j=1 to n;

output;

end;

end;

cards;

2.1 390

2.3 1434

2.5 2643

2.7 3546

2.9 5692

3.1 5187

3.3 4333

3.5 2767

3.7 1677

3.9 1137

4.1 667

4.3 346

4.5 181

;

run;

proc means n skewness kurtosis;

var y;

run;

The SAS System

Analysis Variable : Y

n Skewness Kurtosis

---------------------------------

30000 0.4106458 0.0587006

---------------------------------

样本含量n=30000,是一个很大的样本,样本的偏斜度和峭度都已经很可靠了。偏斜度为0.41,有一个明显的正偏。

1.14 马边河贝氏高原鳅繁殖群体体重分布如下[5]:

体质量/g 中值雌鱼雄鱼

2.00~

3.00 2.50 1 4

3.00~

4.00 3.50 6 7

4.00~

5.00 4.50 13 11

5.00~

6.00 5.50 30 25

6.00~

7.00 6.50 25 25

7.00~8.00 7.50 16 23

8.00~9.00 8.50 21 17

9.00~10.00 9.50 18 16

10.00~11.00 10.50 12 4

11.00~12.00 11.50 3

12.00~13.00 12.50 2

首先判断数据的类型,然后分别绘制雌鱼和雄鱼的频数分布图,计算样本平均数、标准差、偏斜度和峭度并比较两者的变异程度。

答:鱼的体重为度量数据,表中第一列所给出的数值为组限。在下面的分布图中雌鱼和雄鱼的分布绘在了同一张图上,以不同的颜色表示。

计算统计量的SAS程序与前面的例题类似,这里不再给出,只给出结果。

雌鱼:

The SAS System

Analysis Variable : Y

N Mean Std Dev Skewness Kurtosis

-----------------------------------------------------------

147 7.2414966 2.1456820 0.2318337 -0.6758677

-----------------------------------------------------------

雄鱼:

The SAS System

Analysis Variable : Y

N Mean Std Dev Skewness Kurtosis

-----------------------------------------------------------

132 6.7803030 1.9233971 -0.1322816 -0.5510332

-----------------------------------------------------------

直观地看,雄鱼的平均体重低于雌鱼。雌鱼有一正偏,雄鱼有一负偏。因此,相对来说雌鱼低体重者较多,雄鱼高体重者较多。但两者都有很明显的负峭度,说明“曲线”较平坦,两

尾翘得较高。

1.15 黄胸鼠体重的频数分布[6]:

组 界/g 频 数

0<≤15 10 15<≤30 26 30<≤45 30 45<≤60 22 60<≤75

22

75<≤90 17 90<≤105 16 105<≤120 14 120<≤135 6 135<

≤150

4

150<≤165

2

总 数

169

绘制频数分布图,从图形上看分布是对称的吗,说明什么问题?

答:下面是频数分布图:

从上图可见,图形不是对称的,有一些正偏。说明在该黄雄鼠群体中,低体重者分布数量,高于高体重者的数量。另外,似乎峭度也有些低。

1.16 25名患者入院后最初的白细胞数量(×103)[7] 如下表:

8

5 12 4 11

6 8

7 7 12 7 3 11 14 11 9 6 6 5 6 10

14

4

5

5

计算白细胞数量的平均数、方差和标准差。

答:用means 过程计算,程序不再给出,只给出运行结果。

The SAS System

Analysis Variable : Y

y y

y y y y y y y y

y

N Mean Variance Std Dev ------------------------------------------- 25 7.8400000 10.3066667 3.2103998 --------------------------------------------

1.17 细胞珠蛋白基因(CYGB )可能是非小细胞肺癌(NSCLC )的抑制基因之一。一个研究小组研究了该基因的表达、启动子甲基化和等位基因不平衡状态等,以便发现它与肿瘤发病间的关联。下面列出了其中15名患者的基因表达(肿瘤患者/正常对照,T/N ),肿瘤患者与正常对照甲基化指数差(MtI T -MtI N )[8]:

样本号

T/N

MtI T -MtI N

357

0.014 0.419 370 0.019 0.017 367 0.035 0.105 316 0.044 0.333 369

0.054

0.170

358 0.084 0.246 303 0.111 0.242 314 0.135 0.364 308 0.236 0.051 310

0.253

0.520

341 0.264 0.200 348 0.315 0.103 323 0.359 0.167 360 0.422 0.176 336

0.442

0.037

计算以上两项指标的平均数和标准差并计算两者的变异系数,这两个变异系数可以比较吗?为什么?

答:记 T/N 为,MtI T -MtI N 为,用means 过程计算,SAS 运行的结果见下表:

The SAS System

Variable N Mean Std Dev CV

------------------------------------------------------ Y1 15 0.1858000 0.1505624 81.0346471 Y2 15 0.2100000 0.1465274 69.7749634 ------------------------------------------------------

两个变异系数是可以比较的,因为它们的标准差都是用平均数标准化了的,已经不存在不同 单位的影响了。

1y 2y

生物统计学考试题及答案

重庆西南大学 2012 至 2013 学年度第 2 期 生物统计学 试题(A ) 试题使用对象: 2011 级 专业(本科) 命题人: 考试用时 120 分钟 答题方式采用: 闭卷 说明:1、答题请使用黑色或蓝色的钢笔、圆珠笔在答题纸上书写工整. 2、考生应在答题纸上答题,在此卷上答题作废. 一:判断题;(每小题1分,共10分 ) 1、正确无效假设的错误为统计假设测验的第一类错误。( ) 2、标准差为5,B 群体的标准差为12,B 群体的变异一定大于A 群体。( ) 3、一差异”是指仅允许处理不同,其它非处理因素都应保持不变。( ) 4、30位学生中有男生16位、女生14位,可推断该班男女生比例符合1∶1 (已知84.321,05.0=χ)。 ( ) 5、固定模型中所得的结论仅在于推断关于特定的处理,而随机模型中试验结论则将用于推断处理的总体。( ) 6、率百分数资料进行方差分析前,应该对资料数据作反正弦转换。( ) 7、比较前,应该先作F 测验。 ( ) 8、验中,测验统计假设H 00:μμ≥ ,对H A :μμ<0 时,显著水平为5%,则测验的αu 值为1.96( ) 9、行回归系数假设测验后,若接受H o :β=0,则表明X 、Y 两变数无相关关系。 ( ) 10、株高的平均数和标准差为30150±=±s y (厘米),果穗长的平均数和标准差为s y ±1030±=(厘米),可认为该玉米的株高性状比果穗性状变异大。 ( ) 二:选择题;(每小题2分,共10分 ) 1分别从总体方差为4和12的总体中抽取容量为4的样本,样本平均数分别为3和2,在95%置信度下总体平均数差数的置信区间为( )。 A 、[-9.32,11.32] B 、[-4.16,6.16]

生物统计学试题及答案

生物统计学考试 一.判断题(每题2分,共10分) √1. 分组时,组距和组数成反比。 ×2. 粮食总产量属于离散型数据。 ×3. 样本标准差的数学期望是总体标准差。 ×4. F分布的概率密度曲线是对称曲线。 √5. 在配对数据资料用t检验比较时,若对数n=13,则查t表的自由度为12。 二. 选择题(每题3分,共15分) 6.x~N(1,9),x1,x2,…,x9是X的样本,则有() x N(0,1)B.11 - x ~N(0,1)C.91 - x ~N(0,1)D.以上答案均不正确 7. 假定我国和美国的居民年龄的方差相同。现在各自用重复抽样方法抽取本国人口的1%计 算平均年龄,则平均年龄的标准误() A.两者相等 B.前者比后者大 D.不能确定大小 8. 设容量为16人的简单随机样本,平均完成工作需时13分钟。已知总体标准差为3分钟。 若想对完成工作所需时间总体构造一个90%置信区间,则() u值 B.应用t分布表查出t值 C.应用卡方分布表查出卡方值 D.应用F分布表查出F值 9. 1-α是() A.置信限 B.置信区间 C.置信距 10. 如检验k (k=3)个样本方差s i2 (i=1,2,3)是否来源于方差相等的总体,这种检验在统计上称为 ( )。 B. t检验 C. F检验 D. u检验 三. 填空题(每题3分,共15分) 11. 12. 13. 已知F分布的上侧临界值F0.05(1,60)=4.00,则左尾概率为0.05,自由度为(60,1) 的F 14. 15.已知随机变量x服从N (8,4),P(x < 4.71)(填数字) 四.综合分析题(共60分)

生物统计学(第3版)杜荣骞 课后习题答案 第六章 参数估计

第六章参数估计 6.1以每天每千克体重52 μmol 5-羟色胺处理家兔14天后,对血液中血清素含量的影响如下表[9]: y/(μg · L-1)s/(μg · L-1)n 对照组 4.20 0.35 12 5-羟色胺处理组8.49 0.37 9 建立对照组和5-羟色胺处理组平均数差的0.95置信限。 答:程序如下: options nodate; data common; alpha=0.05; input n1 m1 s1 n2 m2 s2; dfa=n1-1; dfb=n2-1; vara=s1**2; varb=s2**2; if vara>varb then F=vara/varb; else F=varb/vara; if vara>varb then Futailp=1-probf(F,dfa,dfb); else Futailp=1-probf(F,dfb,dfa); df=n1+n2-2; t=tinv(1-alpha/2,df); d=abs(m1-m2); lcldmseq=d-t*sqrt(((dfa*vara+dfb*varb)/(dfa+dfb))*(1/n1+1/n2)); ucldmseq=d+t*sqrt(((dfa*vara+dfb*varb)/(dfa+dfb))*(1/n1+1/n2)); k=vara/n1/(vara/n1+varb/n2); df0=1/(k**2/dfa+(1-K)**2/dfb); t0=tinv(1-alpha/2,df0); lcldmsun=d-t0*sqrt(vara/n1+varb/n2); ucldmsun=d+t0*sqrt(vara/n1+varb/n2); cards; 12 4.20 0.35 9 8.49 0.37 ; proc print; id f; var Futailp alpha lcldmseq ucldmseq lcldmsun ucldmsun; title1 'Confidence Limits on the Difference of Means'; title2 'for Non-Primal Data'; run; 结果见下表: Confidence Limits on the Difference of Means for Non-Primal Data F FUTAILP ALPHA LCLDMSEQ UCLDMSEQ LCLDMSUN UCLDMSUN 1.11755 0.42066 0.05 3.95907 4.62093 3.95336 4.62664 首先,方差是具齐性的。在方差具齐性的情况下,平均数差的0.95置信下限为3.959 07,置信上限为4.620 93。0.95置信区间为3.959 07 ~ 4.620 93。 6.2不同年龄的雄岩羊角角基端距如下表[27]: 年龄/a y/cm s/cm n

哈佛大学生物统计学硕士专业有哪些优势

哈佛大学生物统计学硕士专业有哪些优势 2018年哈佛大学生物统计学硕士专业优势: 哈佛大学的生物统计学学院提供了一个无与伦比的环境,以在统计科学方面进行研究和教育,同时处于造福世界人口健康的前沿。 我们的教师是发展统计方法的领导者,用于临床试验和观察研究,研究环境,和基因组学/遗传学。 我们的毕业生拥有优秀的分析和计算能力,在学术界、行业、政府以及其他领域都有广泛的职业发展。 我们在计算生物学、定量基因组学和海量数据分析方面的创新方法在理论和应用上得到了深入的研究。 我们独特的社区在哈佛医学院、达纳-法伯癌症研究所和波士顿 的世界级医院提供了无数的资源和合作机会。 有了丰富的创新史,哈佛大学的生物统计学系为学生们提供了一个绝佳的机会,让他们加入到我们的传统中,来解决公共卫生、生 物医学研究和计算生物学方面的最大挑战。我们的项目为学生提供 了在统计理论和方法以及计算方面的严格训练,并利用他们在课堂 上学到的东西来解决现实世界中的重要问题。 2018年哈佛大学生物统计学硕士项目介绍: 生物统计学硕士项目在统计理论基本知识方面,在医学与公共卫生方面规划研究,进行分析,并撰写报告,解释科学推理数值数据 的研究中,在与科学家关于相关学科协作和有效沟通的能力方面训 练学生。应用领域包括观察性研究、临床试验、计算生物学和定量 基因组学、统计遗传学、医学和公共卫生研究等领域。 该部门提供5个科学硕士课程,每一个都是为有不同背景和目标的学生设计的。

80-creditMasterofScienceinBiostatistics 提供统计理论培训和各种统计和计算方法,用于医学和公共卫生方面的应用。本课程适合学生在完成学业或硕士阶段的医学研究工作。该计划针对的是那些正在考虑在生物统计学、统计学、生物信 息学或诸如流行病学、环境卫生或医学等相关领域的博士水平工作 的学生。SM2计划也适用于那些寻求更多样化和先进的课程的学生,但他们正在考虑硕士阶段的医学研究职位。 60-creditMasterofScienceinBiostatistics 该项目培养拥有定量本科学位的学生从事大学、医院和行业应用研究职位。这个项目除了课程,需要完成一篇论文。 42.5-creditMasterofScienceinBiostatistics 为具有数学和统计背景的学生设计,在经过一年的学习后达到熟练程度,可与80学时的项目相媲美。在一个数学科学或一个定量领 域拥有硕士学位的学生可能有资格参加一年的SM计划。 80-creditMasterofScienceinCompBio&QuantitativeGenetics 该项目与流行病学系合作,为学生提供严格的量化训练和必要的技能,以成功地应对大规模公共卫生数据(大数据)在生物医学研 究中所提出的挑战。它是一个终端专业学位,这将使你能够开启生 物信息学的职业生涯。它也可以提供生物统计学,流行病学、计算 生物学等相关领域进一步博士研究的基础。 60-creditMasterofScienceinHealthDataScience 该项目为学生提供严格的定量培训和必要的管理和分析卫生科学数据的计算技能,以解决当今在公共卫生,医学和基础生物学中最 重要的问题。

生物统计学考试题及答案

生物统计学考试题及答案

重庆西南大学 2012 至 2013 学年度第 2 期 生物统计学 试题(A ) 试题使用对象: 2011 级 专 业(本科) 命题人: 考试用时 120 分钟 答题方式采用: 一:判断题;(每小题1分,共10分 ) 1、正确无效假设的错误为统计假设测验的第一类错误。( ) 2、标准差为5,B 群体的标准差为12,B 群体的变异一定大于A 群体。( ) 3、一差异”是指仅允许处理不同,其它非处理因素都应保持不变。( ) 4、30位学生中有男生16位、女生14位,可推断该班男女生比例符合1∶1(已 知84.321,05.0=χ)。 ( ) 5、固定模型中所得的结论仅在于推断关于特定的处理,而随机模型中试验结论则将用于推断处理的总体。( ) 6、率百分数资料进行方差分析前,应该对资料数据作反正弦转换。( ) 7、比较前,应该先作F 测验。 ( ) 8、验中,测验统计假设H 00:μμ≥ ,对H A :μμ<0 时,显著水平为5%,则测验的αu 值为1.96( ) 9、行回归系数假设测验后,若接受H o :β=0,则表明X 、Y 两变数无相关关系。( ) 10、株高的平均数和标准差为30150±=±s y (厘米),果穗长的平均数和标准差为s y ±1030±=(厘米),可认为该玉米的株高性状比果穗性状变异大。 ( ) 二:选择题;(每小题2分,共10分 ) 1分别从总体方差为4和12的总体中抽取容量为4的样本,样本平均数分别为3和2,在95%置信度下总体平均数差数的置信区间为( )。

A 、[-9.32,11.32] B 、[-4.16,6.16] C 、[-1.58,3.58] D 、都不是 2、态分布不具有下列哪种特征( )。 A 、左右对称 B 、单峰分布 C 、中间高、两头低 D 、概率处处相等 3、一个单因素6个水平、3次重复的完全随机设计进行方差分析,若按最小显著差数法进行多重比较,比较所用的标准误及计算最小显著差数时查表的自由度分别为( )。 A 、 2MSe/6 , 3 B 、 MSe/6 , 3 C 、 2MSe/3 , 12 D 、 MSe/3 , 12 4、已知),N(~x 2σμ,则x 在区间]96.1,[σμ+-∞的概率为( )。 A 、0.025 B 、0.975 C 、0.95 D 、0.05 5、 方差分析时,进行数据转换的目的是( )。 A. 误差方差同质 B. 处理效应与环境效应线性可加 C. 误差方差具有正态性 D. A 、B 、C 都对 三、简答题;(每小题6分,共30分 ) 1、方差分析有哪些步骤? 2、统计假设是?统计假设分类及含义? 3、卡方检验主要用于哪些方面? 4、显著性检验的基本步骤? 5、平均数有哪些?各用于什么情况? 四、计算题;(共4题、50分) 1、进行大豆等位酶Aph 的电泳分析,193份野生大豆、223份栽培大豆等位基因型的次数列于下表。试分析大豆Aph 等位酶的等位基因型频率是否因物种而不同。( 99 .52 05.0,2=χ, 81 .7205.0,3=χ)(10分) 野生大豆和栽培大豆Aph 等位酶的等位基因型次数分布 物 种 等位基因型 1 2 3 野生大豆 29 68 96

生物统计学

生物统计学-数理统计对生命的诠释 生物统计(biostatistics)即用数理统计的原理和方法,分析和解释生物界的种种现象和数据资料,以求把握其本质和规律性。这个专业非常Interdisciplinary ,跟统计、生物信息、计算机(尤其是data mining)等关系很密切。 生统学什么?在美国的专业设置以及课程设置是怎样的? 先从生物统计项目的开设情况说起,在美国Top30的学校中,有19所学校开设了生统的Master项目,Top70的院校中超过一半的学校均开设有Biostatistics项目。 按学院名称分类: School of Public Health - e.g. JHU, Harvard, Yale, Columbia, Emory, U Mich, Brown etc. School/ College of Medicine, Medical Center

-e.g. Duke, U Penn, WUSTL, USC, Case etc. School of Arts and Science -e.g. UCD, Connecticut etc. 这其中,大部分学校是开设在公共卫生学院下的(School of Public Health) 按项目名称分类: -MS/MA in Biostatistics -MPH/MSPH in Biostatistics MPH in Biostatistics核心课程,以Emory为例: Statistical Methods-统计方法 Statistics for Experimental Biology-统计实验生物学 Biostatistical Methods-生物统计方法 Statistical Inference-统计推断 Probability Theory-概率论 Modern Regression Analysis-现代回归分析 SAS Programming-SAS编程 Statistical Computing-统计计算 Stochastic Processes-随机过程 一般来说要求的先修课程: Multivariable Calculus-多元微积分

生物统计学期末复习题

统计选择题 1,由于(1,研究对象本身的性质)造成我们所遇到的各种统计数据的不齐性。 2,研究某一品种小麦株高,因为该品种小麦是个极大的群体,其数量甚至于是个天文数字,该体属于(4,无限总体) 3,从总体中(2,随机抽出)一部分个体称为样本。 4,用随机抽样方法从总体中获得一个样本的过程称为(3,抽样) 5,身高,体重,年龄这一类数据属于(3,连续型数据;1,度量数据) 6,每10个中男性人数,每亩麦田中杂草株数,喷洒农药后每100只害虫中死虫数等,这一类数据属于(1,离散型数据;2,计数数据) 7,把频数按其组值的顺序排列起来,称为(3,频数分布) 8,以组值作为一个边,相应的频数为另一个边,做成的连续矩形图称为(2,直方图)9,绘制(4,多边形图)的方法是在坐标平面内点上各点(中值,频数),以线段连接各点,最高和最低非零频数点与相邻零频数点相连。 10,累积频数图是根据(3,累积频数表)直接绘出的。 11,样本数据总和除以样本含量,称为(算数平均数 12,已知样本平方和为360,样本含量为10,以下4种结果中(2,6.0)是正确的标准差。 13,概率的古典定义是(2,基本事件数与事件总数之比) 14,下面第(2,概率是事物所固有的特性) 15,对于事件A和B,P(A∪B)等于(2,P(AB)) 16,对于事件A和事件B,P(A|B)等于(P(AB)/P(B)) 17,对于任意事件A和B,P(AB)等于(P(B)P(B|A)) 18,下述(3随机试验中所输入的变量)项称为随机变量 19,关于连续型随机变量,有以下4种提法,其中(1,可取某一区间内的任何数值)20,总体平均数可以用以下4种符号中的一种表示,它是(2,μ) 21,样本标准差可以用以下4种符号中的一种表示,它是(1,s) 22,在养鱼场中,A鱼塘的面积占10%,A鱼塘中鱼的发病率为1%,问从养鱼场中任意捕捞一条鱼,它既是A鱼塘,又是生病的鱼的概率是(4,0.003) 23,以下4点是描述连续型随机变量特征的,其中(2,f(x)=lim △x→0P(x

生物统计学答案 第一章 统计数据的收集与整理

第一章 统计数据的收集与整理 1.1 算术平均数是怎样计算的?为什么要计算平均数? 答:算数平均数由下式计算:,含义为将全部观测值相加再被观测值的个数 除,所得之商称为算术平均数。计算算数平均数的目的,是用平均数表示样本数据的集中点, 或是说是样本数据的代表。 1.2 既然方差和标准差都是衡量数据变异程度的,有了方差为什么还要计算标准差? 答:标准差的单位与数据的原始单位一致,能更直观地反映数据地离散程度。 1.3 标准差是描述数据变异程度的量,变异系数也是描述数据变异程度的量,两者之间有什么不同? 答:变异系数可以说是用平均数标准化了的标准差。在比较两个平均数不同的样本时所得结果更可靠。 1.4 完整地描述一组数据需要哪几个特征数? 答:平均数、标准差、偏斜度和峭度。 1.5 下表是我国青年男子体重(kg )。由于测量精度的要求,从表面上看像是离散型数据,不要忘记,体重是通过度量得到的,属于连续型数据。根据表中所给出的数据编制频数分布表。 66 69 64 65 64 66 68 65 62 64 69 61 61 68 66 57 66 69 66 65 70 64 58 67 66 66 67 66 66 62 66 66 64 62 62 65 64 65 66 72 60 66 65 61 61 66 67 62 65 65 61 64 62 64 65 62 65 68 68 65 67 68 62 63 70 65 64 65 62 66 62 63 68 65 68 57 67 66 68 63 64 66 68 64 63 60 64 69 65 66 67 67 67 65 67 67 66 68 64 67 59 66 65 63 56 66 63 63 66 67 63 70 67 70 62 64 72 69 67 67 66 68 64 65 71 61 63 61 64 64 67 69 70 66 64 65 64 63 70 64 62 69 70 68 65 63 65 66 64 68 69 65 63 67 63 70 65 68 67 69 66 65 67 66 74 64 69 65 64 65 65 68 67 65 65 66 67 72 65 67 62 67 71 69 65 65 75 62 69 68 68 65 63 66 66 65 62 61 68 65 64 67 66 64 60 61 68 67 63 59 65 60 64 63 69 62 71 69 60 63 59 67 61 68 69 66 64 69 65 68 67 64 64 66 69 73 68 60 60 63 38 62 67 65 65 69 65 67 65 72 66 67 64 61 64 66 63 63 66 66 66 63 65 63 67 68 66 62 63 61 66 61 63 68 65 66 69 64 66 70 69 70 63 64 65 64 67 67 65 66 62 61 65 65 60 63 65 62 66 64 答:首先建立一个外部数据文件,名称和路径为:E:\data\exer1-5e.dat 。所用的SAS 程序和计算结果如下: proc format; value hfmt 56-57='56-57' 58-59='58-59' 60-61='60-61' 62-63='62-63' 64-65='64-65' 66-67='66-67' 68-69='68-69' 70-71='70-71' 72-73='72-73' 74-75='74-75'; run; n y y n i i ∑== 1

李春喜《生物统计学》第三版 课后作业答案知识分享

李春喜《生物统计学》第三版课后作 业答案

《生物统计学》第三版课后作业答案 (李春喜、姜丽娜、邵云、王文林编著) 第一章概论(P7) 习题1.1 什么是生物统计学?生物统计学的主要内容和作用是什么? 答:(1)生物统计学(biostatistics)是用数理统计的原理和方法来分析和解释生物界各种现象和实验调查资料,是研究生命过程中以样本来推断总体的一门学科。 (2)生物统计学主要包括实验设计和统计推断两大部分的内容。其基本作用 表现在以下四个方面:①提供整理和描述数据资料的科学方法;②确定某些性状和特性的数量特征;③判断实验结果的可靠性;④提供由样本推断总体的方法;⑤提供实验设计的一些重要原则。 习题1.2 解释以下概念:总体、个体、样本、样本容量、变量、参数、统计数、效应、互作、随机误差、系统误差、准确性、精确性。 答:(1)总体(populatian)是具有相同性质的个体所组成的集合,是研究对象的全体。 (2)个体(individual)是组成总体的基本单元。 (3)样本(sample)是从总体中抽出的若干个个体所构成的集合。 (4)样本容量(sample size)是指样本个体的数目。 (5)变量(variable)是相同性质的事物间表现差异性的某种特征。 (6)参数(parameter)是描述总体特征的数量。

(7)统计数(statistic)是由样本计算所得的数值,是描述样本特征的数量。 (8)效应(effection)试验因素相对独立的作用称为该因素的主效应,简称效应。 (9)互作(interaction)是指两个或两个以上处理因素间的相互作用产生的效应。 (10)实验误差(experimental error)是指实验中不可控因素所引起的观测值偏 离真值的差异,可以分为随机误差和系统误差。 (11)随机误差(random)也称抽样误差或偶然误差,它是有实验中许多无法控 制的偶然因素所造成的实验结果与真实结果之间产生的差异,是不可避 免的。随机误差可以通过增加抽样或试验次数降低随机误差,但不能完 全消。 (12) 系统误差(systematic)也称为片面误差,是由于实验处理以外的其他 条件明显不一致所产生的倾向性的或定向性的偏差。系统误差主要由一 些相对固定的因素引起,在某种程度上是可控制的,只要试验工作做得 精细,在试验过程中是可以避免的。 (13) 准确性(accuracy)也称为准确度,指在调查或实验中某一实验指标或 性状的观测值与其真值接近的程度。 (14) 精确性(precision)也称精确度,指调查或实验中同一实验指标或性状 的重复观测值彼此接近程度的大小。 (15)准确性是说明测定值堆真值符合程度的大小,用统计数接近参数真值 的程度来衡量。精确性是反映多次测定值的变异程度,用样本间的各 个变量间变异程度的大小来衡量。

生物统计学考试试卷及答案

考试轮次:2017-2018学年第一学期期末考试试卷编号 考试课程:[120770] 生物统计与实验设计命题负责人曾汉元 适用对象:生物与食品工程学院生物科学专业2015级审查人签字 考核方式:上机考试试卷类型:A卷时量:150分钟总分:100分 注意:答案中要求保留必要的计算和推理过程,全部答案保存为一个Word文档,文件名 为学号最后两位数+姓名。考试结束后不要关机。提交答卷后,请到主机看一下是否提交成功。第1题12分,第3题5分,第10题13分,其余的题各10分。 1、下表为某大学96位男生的体重测定结果(单位:kg),请根据资料分别计算以下指标:(1)算术平均数;(2)几何平均数;(3)中位数;(4)众数;(5)极差;(6)方差;(7)标准差;(8)变异系数;(9)标准误。(10) 绘制各体重分布柱形图。 66 69 64 65 64 66 70 64 59 67 66 66 60 66 65 61 61 66 67 68 62 63 70 65 64 66 68 64 63 60 60 66 65 61 61 66 59 66 65 63 58 66 66 68 64 65 71 61 62 69 70 68 65 63 66 65 67 66 74 64 70 64 59 67 66 66 60 66 65 61 61 66 67 68 62 63 70 65 64 66 68 64 63 60 60 66 65 61 61 66 59 66 65 63 58 66 2、已知1000株水稻的株高服从正态分布N(97,3 2),求: (1)株高在94cm以上的概率? (2)株高在90~99cm之间的概率? (3)株高在多少cm之间的中间概率占全体的99%? 3.已知某批30个小麦样品的平均蛋白质含量为14.5%,σ=2.50%,试进行95%置信度下的蛋白质含量的区间估计和点估计。 4、有一大麦杂交组合,F2代的芒性状表型有钩芒、长芒和短芒三种,观察计得其株数依次分别为348、11 5、157,试检验其比率是否符合9:3:4的理论比率。 5、某医院用某种中药治疗7例再生障碍性贫血患者,现将血红蛋白含量(g/L)变化的数据列在下面,假定资料满足各种假设测验所要求的前提条件,问:治疗前后之间的差别有无显著性意义? 患者编号 1 2 3 4 5 6 7 治疗前血红蛋白含量65 75 50 76 65 72 68 治疗后血红蛋白含量82 112 125 85 80 105 128

生物统计学期末复习题库及答案

第一章 填空 1.变量按其性质可以分为(连续)变量和(非连续)变量。 2.样本统计数是总体(参数)的估计值。 3.生物统计学是研究生命过程中以样本来推断(总体)的一门学科。 4.生物统计学的基本内容包括(试验设计)和(统计分析)两大部分。 5.生物统计学的发展过程经历了(古典记录统计学)、(近代描述统计学)和(现代推断统计学)3个阶段。 6.生物学研究中,一般将样本容量(n ≥30)称为大样本。 7.试验误差可以分为(随机误差)和(系统误差)两类。 判断 1.对于有限总体不必用统计推断方法。(×) 2.资料的精确性高,其准确性也一定高。(×) 3.在试验设计中,随机误差只能减小,而不能完全消除。(∨) 4.统计学上的试验误差,通常指随机误差。(∨) 第二章 填空 1.资料按生物的性状特征可分为(数量性状资料)变量和(质量性状资料)变量。 2. 直方图适合于表示(连续变量)资料的次数分布。 3.变量的分布具有两个明显基本特征,即(集中性)和(离散性)。 4.反映变量集中性的特征数是(平均数),反映变量离散性的特征数是(变异数)。 5.样本标准差的计算公式s=( )。 判断题 1. 计数资料也称连续性变量资料,计量资料也称非连续性变量资料。(×) 2. 条形图和多边形图均适合于表示计数资料的次数分布。(×) 3. 离均差平方和为最小。(∨) 4. 资料中出现最多的那个观测值或最多一组的中点值,称为众数。(∨) 5. 变异系数是样本变量的绝对变异量。(×) 单项选择 1. 下列变量中属于非连续性变量的是( C ). A. 身高 B.体重 C.血型 D.血压 2. 对某鱼塘不同年龄鱼的尾数进行统计分析,可做成( A )图来表示. A. 条形 B.直方 C.多边形 D.折线 3. 关于平均数,下列说法正确的是( B ). A. 正态分布的算术平均数和几何平均数相等. B. 正态分布的算术平均数和中位数相等. C. 正态分布的中位数和几何平均数相等. D. 正态分布的算术平均数、中位数、几何平均数均相等。 4. 如果对各观测值加上一个常数a ,其标准差( D )。 A. 扩大√a 倍 B.扩大a 倍 C.扩大a 2倍 D.不变 5. 比较大学生和幼儿园孩子身高的变异度,应采用的指标是( C )。 A. 标准差 B.方差 C.变异系数 D.平均数 第三章 12 2--∑∑n n x x )(

耶鲁大学生物统计学专业介绍

耶鲁大学生物统计学专业介绍 耶鲁大学生物统计学专业由公共卫生学院提供。耶鲁大学目前在QS世界排名第15位,在美国排名第8位。该校统计学目前在美国 排名第31位,一起来了解。 1.专业概况 耶鲁大学生物统计学硕士生学习生物医学科学领域的统计方法理论和应用。毕业生中一直有人从事保健科学行业,在生物技术企业、政府部门、制药公司就业。 申请这个生物统计学专业需要有数学、统计学和一门定量学科学习经历。数学的最低要求是学过一年微积分和一门线性代数。 除了生物统计学理学硕士,耶鲁大学也在这个领域开设公共卫生硕士专业。如果你想进一步了解这个公共卫生硕士专业,了解理学 硕士与公共卫生硕士的不同,请参加公共卫生硕士生物统计学网页。 请注意,理学硕士和公共卫生硕士可以同时申请。 2.学位要求 生物统计学理学硕士要求至少完成15个学分,学生必须完成以 下课程。 生物统计学与文献报告会(JournalClub)研讨、临床试验基础(一个学分)、应用回归分析(一个学分)、分类数据分析(一个学分)、纵 向与多层面数据分析(一个学分)、应用生存分析(一个学分)、统计 实践(第一部分、一个学分)、高级统计编程(一个学分)、统计实践(第二部分、一个学分)、概率理论(一个学分)、统计学理论(一个学分)、流行病学与公共卫生基础(一个学分)、生物统计学研究夏季实习。研究伦理学与责任。

从以下课程选择二门选修: 计算统计学(一个学分)、贝叶斯统计(一个学分)、生存分析理论(一个学分)、非参数统计方法及其应用(一个学分)、公共卫生空间统计学(一个学分)、广义线性模型理论(一个学分)。 此外,生物统计学专业的所有硕士生还需要完成一个专业发展系列。 有意向完成一篇论文的学生可以选择这样做。选择完成论文的学生必须在公开研讨会上展示研究成果,才能毕业。已经拿到公共卫生硕士或相关研究生学位的学生可以免除这个要求。 3.硕士论文 第二年的时候,生物统计学理学硕士方向的学生可以选择在老师指导下完成一个独立研究。这个研究项目一般要落在以下三个主要领域,它们分别是统计学新理论/方法论发展、现有方法特征的计算机辅助模拟、实时数据集分析。 如果选择提交一篇论文,学生将必须提交一篇书面和完成答辩才能毕业。所提交的论文必须是在生物统计学教职人员监督下完成。

2017福师《生物统计学》答案

一、单选题(共 32 道试题,共 64 分。) V 1. 最小二乘法是指各实测点到回归直线的 A. 垂直距离的平方和最小 B. 垂直距离最小 C. 纵向距离的平方和最小 D. 纵向距离最小 2. 被观察到对象中的()对象称为() A. 部分,总体 B. 所有,样本 C. 所有,总体 D. 部分,样本 3. 必须排除______因素导致“结果出现”的可能,才能确定“结果出现”是处理因素导致的。只有确定了______,才能确定吃药后出现的病愈是药导致的。 A. 非处理因素,不吃药就不可能出现病愈 B. 处理因素,不吃药就不可能出现病愈 C. 非处理因素,吃药后确实出现了病愈 D. 处理因素,吃药后确实出现了病愈 4. 张三观察到李四服药后病好了。由于张三的观察是“个案”,因此不能确定______。 A. 确实进行了观察 B. 李四病好了 C. 病好的原因 D. 观察结果是可靠的 5. 四个样本率作比较,χ2>χ20.05,ν可认为

A. 各总体率不同或不全相同 B. 各总体率均不相同 C. 各样本率均不相同 D. 各样本率不同或不全相同 6. 下列哪种说法是错误的 A. 计算相对数尤其是率时应有足够的观察单位或观察次数 B. 分析大样本数据时可以构成比代替率 C. 应分别将分子和分母合计求合计率或平均率 D. 样本率或构成比的比较应作假设检验 7. 总体指的是()的()对象 A. 要研究,部分 B. 观察到,所有 C. 观察到,部分 D. 要研究,所有 8. 以下叙述中,除了______外,其余都是正确的。 A. 在比较未知参数是否不等于已知参数时,若p(X>x)<α/2,则x为小概率事件。 B. 在比较未知参数是否等于已知参数时,若p(X=x)<α,则x为小概率事件。 C. 在比较未知参数是否大于已知参数时,若p(X>x)<α,则x为小概率事件。 D. 在比较未知参数是否小于已知参数时,若p(X

李春喜《生物统计学》第三版课后作业答案

《生物统计学》第三版课后作业答案(李春喜、姜丽娜、邵云、王文林编着) 第一章概论(P7) 习题1.1 什么是生物统计学?生物统计学的主要内容和作用是什么?答:(1)生物统计学(biostatistics)是用数理统计的原理和方法来分析和解释生物界各种现象和实验调查资料,是研究生命过程中以样本来推断总体的一门学科。 (2)生物统计学主要包括实验设计和统计推断两大部分的内容。其基本 作用表现在以下四个方面:①提供整理和描述数据资料的科学方法; ②确定某些性状和特性的数量特征;③判断实验结果的可靠性;④提 供由样本推断总体的方法;⑤提供实验设计的一些重要原则。 习题1.2 解释以下概念:总体、个体、样本、样本容量、变量、参数、统计数、效应、互作、随机误差、系统误差、准确性、精确性。答:(1)总体(populatian)是具有相同性质的个体所组成的集合,是研究对象的全体。 (2)个体(individual)是组成总体的基本单元。 (3)样本(sample)是从总体中抽出的若干个个体所构成的集合。 (4)样本容量(sample size)是指样本个体的数目。 (5)变量(variable)是相同性质的事物间表现差异性的某种特征。 (6)参数(parameter)是描述总体特征的数量。 (7)统计数(statistic)是由样本计算所得的数值,是描述样本特征的数量。

(8)效应(effection)试验因素相对独立的作用称为该因素的主效应,简称效应。 (9)互作(interaction)是指两个或两个以上处理因素间的相互作用产生的效应。 (10)实验误差(experimental error)是指实验中不可控因素所引起的 观测值偏离真值的差异,可以分为随机误差和系统误差。 (11)随机误差(random)也称抽样误差或偶然误差,它是有实验中许多无 法控制的偶然因素所造成的实验结果与真实结果之间产生的差异,是不可避免的。随机误差可以通过增加抽样或试验次数降低随机误差,但不能完全消。 (12) 系统误差(systematic)也称为片面误差,是由于实验处理以外 的其他条件明显不一致所产生的倾向性的或定向性的偏差。系统误 差主要由一些相对固定的因素引起,在某种程度上是可控制的,只要 试验工作做得精细,在试验过程中是可以避免的。 (13) 准确性(accuracy)也称为准确度,指在调查或实验中某一实验 指标或性状的观测值与其真值接近的程度。 (14) 精确性(precision)也称精确度,指调查或实验中同一实验指标 或性状的重复观测值彼此接近程度的大小。 (15)准确性是说明测定值堆真值符合程度的大小,用统计数接近参数真 值的程度来衡量。精确性是反映多次测定值的变异程度,用样本间 的各个变量间变异程度的大小来衡量。 习题1.3 误差与错误有何区别?

生物统计学习题

第一章绪论 一、名词解释 总体个体样本样本含量随机样本参数统计量准确性精确性 第二章资料的整理 一、名词解释 数量性状资料质量性状资料半定量(等级)资料计数资料计量资料 第三章平均数、标准差与变异系数 一、名词解释 算术平均数几何平均数中位数众数调和平均数标准差方差离均差的平方和(平方和)变异系数 二、简答题 1、生物统计中常用的平均数有几种?各在什么情况下应用? 2、算术平均数有哪些基本性质? 3、标准差有哪些特性? 三、应用题 计算下面两个玉米品种的10个果穗长度(cm)的平均数、标准差和变异系数,解释所得结果。 BS24:19 21 20 20 18 19 22 21 21 19 金皇后:16 21 24 15 26 18 20 19 22 19 四、计算题 1、10头母猪第一胎的产仔数分别为:9、8、7、10、1 2、10、11、14、8、9头。试计算这10头母猪第一胎产仔数的平均数、标准差和变异系数。 2、随机测量了某品种120头6月龄母猪的体长,经整理得到如下次数分布表。试利用加权法计算其平均数、标准差与变异系数。 组别组中值(x)次数(f) 80—84 2 88—92 10

96— 100 29 104— 108 28 112— 116 20 120— 124 15 128— 132 13 136— 140 3 3、某年某猪场发生猪瘟病,测得10头猪的潜伏期分别为2、2、3、3、 4、4、4、 5、9、12(天)。试求潜伏期的中位数。 4、某良种羊群1995—2000年六个年度分别为240、320、360、400、420、450只,试求该良种羊群的年平均增长率。 5、某保种牛场,由于各方面原因使得保种牛群世代规模发生波动,连续5个世代的规模分别为:120、130、140、120、110头。试计算平均世代规模。 6、调查甲、乙两地某品种成年母水牛的体高(cm )如下表,试比较两地成年母水牛体高的变异程度。 甲地 137 133 130 128 127 119 136 132 乙地 128 130 129 130 131 132 129 130 第四章 常用概率分布 一、名词解释 随机事件 概率的统计定义 小概率原理 正态分布 标准正态分布 双侧概率(两尾概率) 单侧概率(一尾概率) 二项分布 波松分布 标准误 二、简答题 1、事件的概率具有那些基本性质? 2、正态分布的密度曲线有何特点? 3、标准误与标准差有何联系与区别? 4、样本平均数抽样总体与原始总体的两个参数间有何联系? 三、计算题 1、 已知随机变量u 服从 N(0,1),求P(u <-1.4), P(u ≥1.49), P (|u |≥2.58), P(-1.21≤u <0.45),并作图示意。 2、已知随机变量u 服从N(0,1),求下列各式的αu 。 (1) P(u <-αu )+P(u ≥αu )=0.1;0.52 (2) P(-αu ≤u <αu )=0.42;0.95 3、猪血红蛋白含量x 服从正态分布N(12.86,1.332)

《生物统计学》试题A

《生物统计学》基本知识题 一、填空题 第一章 1.填写下列符号的统计意义:①SS ②S x ③ S2 ④ SP xy。 2.t检验、u检验主要用于____ 组数据的差异显著性检验; F 检验主要用于____ _ 组数据的差异显著性检验。 3.试验误差指由因素引起的误差,它不可,但可 以和。 4.参数是由____计算得到的,统计量是由____计算得到的。 5.由样本数据计算得到的特征数叫,由总体数据计算 得到的特征数叫。 9.一般将原因产生的误差叫试验误差,它避免, 但可以和。 第二章 4.变异系数可用于当两个样本的、不同时 变异程度的比较。变异系数的计算公式为。 5.变异系数可用于当两个样本的、不同时 的比较。变异系数的计算公式为。 7.连续性随机变量等组距式次数分布表的编制方法步骤为: ①_____、②____、③____、④____、⑤___。 8.计算标准差的公式是S=。 9.变异系数的计算公式是CV=。 10. 标准差的作用是①、②、③。 12.算术平均数的两个重要性质是①②。 13.样本平均数的标准差叫。它与总体标准差的关系 是。 第三章 1.若随机变量x~N(μ,σ2),欲将其转换为u~N(0,1),则 标准化公式为u=。 第四 1.统计量与参数间的误差叫,其大小受①② ③的影响,其大小可以用来描述,计算公式 为。 2.抽样误差是指之差。抽样误差的大小可用来表 示。影响抽样误差的因素有、和。 6.在两个均数的显著性检验中,若检验结果是差异显著,则说 明。 7.在显著性检验时,当H0是正确的,检验结果却否定了H0,这 时犯的错误是:型错误。 8. 显著性检验时,犯Ⅰ型错误的概率等于。 9.显著性检验分为_______ 检验和______检验。 10.显著性检验的方法步骤为:、、。 12.若服从N(, 2)分布,则值服从分布, 值服从分布。 第五章 1.方差分析是以为检验对象的。在实际分析时常常以 作为它的估计值。 2.多重比较的方法有①和②两类;①一般适用于 组均数的检验,②适用于组均数间的检验。 3.多重比较的LSD法适用于组均数比较;LSR法适用于 组均数间的比较。 4.多重比较的方法有和两类。前者一般用于 组均数检验,后者又包含和法,适用于组 均数的比较。第六章 1.χ2 检验中,连续性矫正是指用性分布检验性数据所产生的差异,当或时,必须进行矫正。 2.在χ2检验时,当和时必须进行连续性矫正。3.χ2检验中,当或时,必须进行连续性矫正,矫正方法有_____ 和_____ 两种。 4.χ2检验的计算公式为χ2=,当、时,必须矫正,其矫正方法为、。 第七章 1.在直线相关回归分析中,相关系数显著,说明两变量间直线相关关系。 2.相关系数的大小,说明相关的紧密程度,其说明相关的性质。 相关系数r是用来描述两变量之间相关的和的指标,r 的正负号表示相关的,r的绝对值大小说明相关的。 3.变量间存在的关系,统计上称为相关关系。 4.回归分析中表示,byx表示,。 5.在回归方程中,表示依变量的,b表示,a表示。 6.已知r=-0.589*,则变量间存在的直线相关关系。 7.统计分析中,用统计量来描述两个变量间的直线相关关系,其取值范围为,其绝对值的大小说明相关的,其正负符号说明相关的。 第九章 1.试验设计的基本原则是、和。 二、单选题 1.比较胸围与体重资料的变异程度,以最好。 a.标准差b.均方c.全距d.变异系数 2.比较身高与体重两变量间的变异程度,用统计量较合适。 ①CV ②S ③R ④S2 4.若原始数据同加(或同减)一个常数,则。 a不变,S改变b.S不变,改变 c.两者均改变d.两者均不改变 5.比较身高和体重资料的变异程度,以指标最好。 a.CV b.Sc.Rd.S2 6.离均差平方和的代表符号是。 a.∑(x- )2 b.SP c.SS 7 .样本离均差平方和的代表符号是。 ①S2 ②③ ④SS 8. 愈小,表示用该样本平均数估计总体均数的可靠性愈大。 ①变异系数②标准差 ③全距④标准误 1.二项分布、Poisson分布、正态分布各有几个参数:() A、 (1,1,1 ) B、 (2,2,2) C、 (2,1, 2) D、 (2,2,1 ) 2.第一类错误是下列哪一种概率:()

相关主题
文本预览
相关文档 最新文档