statsmodels mixedlm结果中[T.类别]的含义:是参考还是目标类别?
关于statsmodels mixedlm中
[T.]后缀类别的解释 1. [T.Pre]的含义
C(Period)[T.Pre]是statsmodels对分类变量执行**虚拟编码(Dummy Coding)**后的输出标识:
C(Period)表示将Period变量按分类变量规则处理;[T.Pre]里的Pre是模型中被作为对比项的类别,模型会计算该类别与参考类别之间的预测值差异。
2. 参考类别的判断
你的Period变量包含Pre和Post两个类别,模型仅输出C(Period)[T.Pre],这说明Post是模型默认的参考类别。
statsmodels对分类变量默认采用Treatment编码策略:先将类别按字母顺序排序,把排序后的第一个类别设为参考,剩余类别作为对比项输出系数。这里Period的类别按字母顺序排序为Post、Pre,因此Post成为参考类别,C(Period)[T.Pre]的系数23.988代表:当Period为Pre时,预测值比Post类别高出23.988(控制其他变量不变的前提下)。
模型结果表格
| blank | Coef. | Std.Err. | z | P>z | [0.025 | 0.975] |
|---|---|---|---|---|---|---|
| Intercept | -91.240 | 30.023 | -3.039 | 0.002 | -150.085 | -32.396 |
| C(Period)[T.Pre] | 23.988 | 5.034 | 0.773 | 0.040 | 14.812 | 36.837 |
内容的提问来源于stack exchange,提问作者Mark Jalapeno
相关产品推荐
相关产品推荐

