按名称删除数据帧列

我想从数据帧中删除一些列。我知道我们可以使用如下方法单独删除它们:

df$x <- NULL

但我希望用更少的命令来做到这一点。

另外，我知道我可以像这样使用整数索引删除列:

df <- df[ -c(1, 3:6, 12) ]

但我担心变量的相对位置可能会改变。

考虑到R的强大功能，我认为可能有一种比逐个删除每一列更好的方法。

当前回答

还有一个子集命令，如果你知道你想要哪些列，它很有用:

df <- data.frame(a = 1:10, b = 2:11, c = 3:12)
df <- subset(df, select = c(a, c))

要删除列a,c，你可以这样做:

df <- subset(df, select = -c(a, c))

其他回答

在数据帧中按列名删除和删除列。

A <- df[ , c("Name","Name1","Name2","Name3")]

另一种可能性:

df <- df[, setdiff(names(df), c("a", "c"))]

df <- df[, grep('^(a|c)$', names(df), invert=TRUE)]

如果你不想使用@hadley's上面的另一个解决方案:如果"COLUMN_NAME"是你想删除的列的名称:

df[,-which(names(df) == "COLUMN_NAME")]

出于兴趣，这标记了R的一个奇怪的多重语法不一致。例如，给定一个两列数据帧:

df <- data.frame(x=1, y=2)

这就给出了一个数据帧

subset(df, select=-y)

但这给出了一个向量

df[,-2]

这些都在?中得到了解释，但这并不是完全预期的行为。至少对我来说不是……

Dplyr解决方案

我怀疑这在这里会得到很多关注，但如果你有一个列列表，你想要删除，并且你想在dplyr链中做它，我在select子句中使用one_of():

这里有一个简单的，可复制的例子:

undesired <- c('mpg', 'cyl', 'hp')

mtcars <- mtcars %>%
  select(-one_of(undesired))

可以通过运行?one_of或在这里找到文档:

http://genomicsclass.github.io/book/pages/dplyr_tutorial.html

推荐文章