7.5 逻辑回归分析 统计学上的定义和计算公式 定义:逻辑回归分析是对定性变量的回归分析。现实中的很多现象可以划分为两种可能,或者归结为两种状态,这两种状态分别用0和1 表示。买汽车回受到家庭、收入等因素的影响,但最终的结果只能是两个:买或不买。如果我们采用多个因素对01 表示的某种现象进行因果关系解释,就可能应用到logistic 回归。例如,想探讨胃癌发生的危险因素,可以选择两组人群,一组是胃癌组,一组是非胃癌组,两组人群肯定有不同的体征和生活方式等。这里的因变量就是是否胃癌,即“是”或“否”,为两分类变量,自变量就可以包括很多了,例如年龄、性别、饮食习惯等。自变量既可以是连续的,也可以是分类的。通过logistic回归分析,就可以大致了解到底哪些因素是胃癌的危险因素。可用于处理定性因变量的统计分析方法有:判别分析(Discriminant analysis)、Probit分析、Logistic回归分析和对数线性模型等。在社会科学中,应用最多的是Logistic回归分析。Logistic回归分析根据因变量取值类别不同,又可以分为Binary Log