- 0
- 0
- 约3.99千字
- 约 22页
- 2019-03-25 发布于福建
- 举报
11回归分析都的基本思想及其初步应用2
第一章 统计案例 线性回归模型y=bx+a+e增加了随机误差项e,因变量y的值由自变量x和随机误差项e共同确定,即自变量x只能解析部分y的变化。 在统计中,我们也把自变量x称为解析变量,因变量y为预报变量。 我们可以用相关指数R2来刻画回归的效果,其计算公式是 显然,R2的值越大,说明残差平方和越小,也就是说模型拟合效果越好。 R2越接近1,表示回归的效果越好(因为R2越接近1,表示解析变量和预报变量的线性相关性越强)。 如果某组数据可能采取几种不同回归方程进行回归分析,则可以通过比较R2的值来做出选择,即选取R2较大的模型作为这组数据的模型。 总的来说: 相关指数R2是度量模型拟合效果的一种指标。 在线性模型中,它代表自变量刻画预报变量的能力。 1、残差 数据点和它在回归直线上相应位置的差异 称为相应于点(xi,yi ) 的残差。 例:编号为6的女大学生,计算随机误差的效应(残差) 2、残差平方和 把每一个残差所得的值平方后加起来,用数学符号表示为: 称为残差平方和 在例1中,残差平方和约为128.361。 编号 1 2 3 4 5 6 7 8 身高/cm 165 165 157 170 175 165 155 170 体重/kg 48 57 50 54 64 61 43 59 残差 -6.373 2.627 2.41
原创力文档

文档评论(0)