如何从一个简单的线性回归模型中提取p值(单个解释变量的系数的显著性为非零)和r平方值?例如……
x = cumsum(c(0, runif(100, -1, +1)))
y = cumsum(c(0, runif(100, -1, +1)))
fit = lm(y ~ x)
summary(fit)
我知道summary(fit)显示了p值和r平方值,但我希望能够将它们插入到其他变量中。
如何从一个简单的线性回归模型中提取p值(单个解释变量的系数的显著性为非零)和r平方值?例如……
x = cumsum(c(0, runif(100, -1, +1)))
y = cumsum(c(0, runif(100, -1, +1)))
fit = lm(y ~ x)
summary(fit)
我知道summary(fit)显示了p值和r平方值,但我希望能够将它们插入到其他变量中。
当前回答
对于summary()末尾显示的最终p值,该函数使用pf()从summary(fit)$fstatistic值中计算。
fstat <- summary(fit)$fstatistic
pf(fstat[1], fstat[2], fstat[3], lower.tail=FALSE)
来源:[1],[2]
其他回答
注意,summary(fit)生成了一个包含您需要的所有信息的对象。se t和p向量都存储在里面。通过选择系数矩阵的第4列来获得p值(存储在summary对象中):
summary(fit)$coefficients[,4]
summary(fit)$r.squared
尝试str(summary(fit))查看该对象包含的所有信息。
编辑:我误解了蔡斯的答案,它基本上告诉你如何得到我在这里给出的东西。
对于summary()末尾显示的最终p值,该函数使用pf()从summary(fit)$fstatistic值中计算。
fstat <- summary(fit)$fstatistic
pf(fstat[1], fstat[2], fstat[3], lower.tail=FALSE)
来源:[1],[2]
@Vincent回答的延伸:
对于lm()生成的模型:
summary(fit)$coefficients[,4] ##P-values
summary(fit)$r.squared ##R squared values
对于gls()生成的模型:
summary(fit)$tTable[,4] ##P-values
##R-squared values are not generated b/c gls uses max-likelihood not Sums of Squares
为了隔离单独的p值本身,你需要在代码中添加一个行号:
例如,要访问两个模型摘要中截距的p值:
summary(fit)$coefficients[1,4]
summary(fit)$tTable[1,4]
注意,你可以在上面的每个实例中用列名替换列号: 总结(适合)$系数[1,“公关(> | t |)“# # lm 总结(适合)$ tTable[1,“假定值 "] ## gl
如果你仍然不确定如何从汇总表中访问一个值,使用str()来找出汇总表的结构:
str(summary(fit))
这是提取p值最简单的方法:
coef(summary(modelname))[, "Pr(>|t|)"]
虽然上面的两个答案都很好,但提取对象部分的过程更一般。
在许多情况下,函数返回列表,并且可以使用str()访问各个组件,str()将打印组件及其名称。然后您可以使用$操作符访问它们,即myobject$componentname。
在lm对象的情况下,有许多预定义的方法可以使用,如coef()、remainder()、summary()等,但你不会总是那么幸运。