在Pandas数据帧中选择多个列

如何从df中选择列a和b，并将它们保存到新的数据帧df1中？

index  a   b   c
1      2   3   4
2      3   4   5

尝试失败：

df1 = df['a':'b']
df1 = df.ix[:, 'a':'b']

当前回答

如果要按行索引和列名获取一个元素，可以像df['b'][0]一样执行。这就像你能想象的那样简单。

或者可以使用df.ix[0，'b']-索引和标签的混合用法。

注意：从v0.20开始，ix已被弃用，取而代之的是loc/iloc。

2018-01-03 07:56:07

其他回答

您可以使用pandas.DataFrame.filter方法对列进行筛选或重新排序，如下所示：

df1 = df.filter(['a', 'b'])

这在链接方法时也非常有用。

2020-04-21 03:03:00

如果要按行索引和列名获取一个元素，可以像df['b'][0]一样执行。这就像你能想象的那样简单。

或者可以使用df.ix[0，'b']-索引和标签的混合用法。

注意：从v0.20开始，ix已被弃用，取而代之的是loc/iloc。

2018-01-03 07:56:07

一种不同且简单的方法：迭代行

使用迭代

 df1 = pd.DataFrame() # Creating an empty dataframe
 for index,i in df.iterrows():
    df1.loc[index, 'A'] = df.loc[index, 'A']
    df1.loc[index, 'B'] = df.loc[index, 'B']
    df1.head()

2018-10-15 11:43:43

前面的答案中讨论的不同方法基于这样的假设：用户知道要删除或子集的列索引，或者用户希望使用一系列列（例如“C”和“E”之间）来子集数据帧。

pandas.DataFrame.drop（）当然是一个基于用户定义的列列表对数据进行子集的选项（尽管您必须谨慎地始终使用数据帧的副本，并且不应将就地参数设置为True！！）

另一个选项是使用pandas.columns.difference（），它对列名进行设置差异，并返回包含所需列的数组的索引类型。以下是解决方案：

df = pd.DataFrame([[2,3,4], [3,4,5]], columns=['a','b','c'], index=[1,2])
columns_for_differencing = ['a']
df1 = df.copy()[df.columns.difference(columns_for_differencing)]
print(df1)

输出将是：

    b   c
1   3   4
2   4   5

2018-07-21 21:28:41

我发现这种方法非常有用：

# iloc[row slicing, column slicing]
surveys_df.iloc [0:3, 1:4]

更多详情请点击此处。

2017-05-02 09:41:52

在Pandas数据帧中选择多个列

推荐文章

最新文章

标签