如何更改DataFrame列的顺序？

我有以下DataFrame（df）：

import numpy as np
import pandas as pd

df = pd.DataFrame(np.random.rand(10, 5))

我通过分配添加更多列：

df['mean'] = df.mean(1)

如何将列的意思移到前面，即将其设置为第一列，而其他列的顺序保持不变？

当前回答

下面是一个超级简单的方法示例。如果您要从excel复制标题，请使用.split（'\t'）

df = df['FILE_NAME DISPLAY_PATH SHAREPOINT_PATH RETAILER LAST_UPDATE'.split()]

2021-11-06 04:42:23

其他回答

此函数避免了您只需列出数据集中的每个变量来对其中的几个变量进行排序。

def order(frame,var):
    if type(var) is str:
        var = [var] #let the command take a string or list
    varlist =[w for w in frame.columns if w not in var]
    frame = frame[var+varlist]
    return frame

它需要两个参数，第一个是数据集，第二个是要放到前面的数据集中的列。

所以在我的例子中，我有一个名为Frame的数据集，其中包含变量A1、A2、B1、B2、Total和Date。如果我想把道达尔带到前面，那么我所要做的就是：

frame = order(frame,['Total'])

如果我想将Total和Date带到前台，那么我会：

frame = order(frame,['Total','Date'])

编辑：

另一种有用的使用方法是，如果您有一个不熟悉的表，并且正在查找其中包含特定术语的变量，例如VAR1、VAR2，。。。您可以执行以下操作：

frame = order(frame,[v for v in frame.columns if "VAR" in v])

2014-07-29 19:30:18

假设您有列为A、B、C的df。

最简单的方法是：

df = df.reindex(['B','C','A'], axis=1)

2020-05-30 05:12:36

我很喜欢Shoresh的回答：当你不知道位置时，使用集合功能来删除列，但这不符合我的目的，因为我需要保持原始的列顺序（具有任意的列标签）。

不过，我通过使用boltons包中的IndexedSet实现了这一点。

我还需要重新添加多个列标签，因此对于更一般的情况，我使用了以下代码：

from boltons.setutils import IndexedSet
cols = list(IndexedSet(df.columns.tolist()) - set(['mean', 'std']))
cols[0:0] =['mean', 'std']
df = df[cols]

希望这对搜索此线程以寻求通用解决方案的任何人都有用。

2017-12-09 04:14:45

我认为这是一个略为简洁的解决方案：

df.insert(0, 'mean', df.pop("mean"))

这个解决方案有点类似于@JoeHeffer的解决方案，但这是一条直线。

这里，我们从数据帧中删除列“mean”，并将其附加到具有相同列名的索引0。

2019-11-05 16:33:40

我自己也遇到了一个类似的问题，只是想补充一下我已经解决的问题。我喜欢用于更改列顺序的reindex_axis（）方法。这是有效的：

df = df.reindex_axis(['mean'] + list(df.columns[:-1]), axis=1)

另一种基于@Jorge评论的方法：

df = df.reindex(columns=['mean'] + list(df.columns[:-1]))

虽然reindex_axis在微基准测试中似乎比reindex稍快，但我认为我更喜欢后者，因为它的直接性。

2014-08-27 19:49:31

如何更改DataFrame列的顺序？

推荐文章

最新文章

标签