从Pandas DataFrame列标题中获取一个列表

我想从Pandas DataFrame中获得列标题的列表。DataFrame将来自用户输入，所以我不知道有多少列或它们将被称为什么。

例如，如果我有一个这样的数据帧:

>>> my_dataframe
    y  gdp  cap
0   1    2    5
1   2    3    9
2   8    7    2
3   3    4    7
4   6    7    7
5   4    8    3
6   8    2    8
7   9    9   10
8   6    6    4
9  10   10    7

我会得到一个这样的列表:

>>> header_list
['y', 'gdp', 'cap']

当前回答

import pandas as pd

# create test dataframe
df = pd.DataFrame('x', columns=['A', 'B', 'C'], index=range(2))

list(df.columns)

['A', 'B', 'C']

2022-04-02 11:49:23

其他回答

我做了一些快速测试，也许不出意外，使用datafframe .columns.values.tolist()的内置版本是最快的:

In [1]: %timeit [column for column in df]
1000 loops, best of 3: 81.6 µs per loop

In [2]: %timeit df.columns.values.tolist()
10000 loops, best of 3: 16.1 µs per loop

In [3]: %timeit list(df)
10000 loops, best of 3: 44.9 µs per loop

In [4]: % timeit list(df.columns.values)
10000 loops, best of 3: 38.4 µs per loop

(尽管如此，我仍然非常喜欢这个列表(数据框架)，所以感谢EdChum!)

2014-12-01 20:31:56

import pandas as pd

# create test dataframe
df = pd.DataFrame('x', columns=['A', 'B', 'C'], index=range(2))

list(df.columns)

['A', 'B', 'C']

2022-04-02 11:49:23

李光复

2021-10-27 22:35:11

它可以作为my_datafframe。columns。

2013-10-20 21:20:06

如果DataFrame碰巧有一个Index或MultiIndex，你也想把它们包括在列名中:

names = list(filter(None, df.index.names + df.columns.values.tolist()))

它避免调用reset_index()，因为对于这样一个简单的操作，reset_index()会造成不必要的性能损失。

我经常遇到这种情况，因为我从数据库中穿梭数据，其中dataframe索引映射到一个主键/唯一键，但对我来说实际上只是另一个“列”。对于熊猫来说，有一个内置的方法可能是有意义的(完全有可能我错过了它)。

2020-01-16 05:24:10

从Pandas DataFrame列标题中获取一个列表

推荐文章

最新文章

标签