§2.4 数据
一、数据的分类 按照数据与时间的关系,可以分为: ❖ 时间序列数据(time series data) ❖ 横截面数据(cross-section data) ❖ 面板数据(panel data/ pooling data)
实例:我国地区的生产总值
二、数据的来源和质量
❖ 社会科学数据都是非实验所得,存在测量误 差,或出于疏漏或差错 ;
cov(Xt,Yt)
Var(Xt) Var(Yt)
样本相关系数r
rXYˆ
1 T1
(Xt X)(Yt Y)
1 T1
(Xt X)2
1 T1
(Yt Y)2
(Xt X)(Yt Y)
(Xt X)2 (Yt Y)2
性质: (1)r具有对称性 (2)r与原点和尺度都无关
400
200
0 0
X
10
20
30
40
50
完全相关
Y 2
1
X
0
10
20
30
40
50
高度相关
3.0
2.5
Y
2.0
1.5
1.0
0.5
2.0
2.5
3.0
3.5
弱相关
X
4.0
4.5
4
Y 2
0
-2
X -4
-4
-2
0
2
4
零相关
2、按变量个数
200 150 100
50 0 0
Y
X
50
100
150
200
250
非线性相关/负相关
Y 2
1