如何更改DataFrame列的顺序？

我有以下DataFrame（df）：

import numpy as np
import pandas as pd

df = pd.DataFrame(np.random.rand(10, 5))

我通过分配添加更多列：

df['mean'] = df.mean(1)

如何将列的意思移到前面，即将其设置为第一列，而其他列的顺序保持不变？

当前回答

这里有一种移动一个现有列的方法，它将修改现有的数据帧。

my_column = df.pop('column name')
df.insert(3, my_column.name, my_column)  # Is in-place

2018-01-04 13:25:54

其他回答

如果列名太长，无法键入，则可以通过整数列表指定新顺序，其中包含以下位置：

数据：

          0         1         2         3         4      mean
0  0.397312  0.361846  0.719802  0.575223  0.449205  0.500678
1  0.287256  0.522337  0.992154  0.584221  0.042739  0.485741
2  0.884812  0.464172  0.149296  0.167698  0.793634  0.491923
3  0.656891  0.500179  0.046006  0.862769  0.651065  0.543382
4  0.673702  0.223489  0.438760  0.468954  0.308509  0.422683
5  0.764020  0.093050  0.100932  0.572475  0.416471  0.389390
6  0.259181  0.248186  0.626101  0.556980  0.559413  0.449972
7  0.400591  0.075461  0.096072  0.308755  0.157078  0.207592
8  0.639745  0.368987  0.340573  0.997547  0.011892  0.471749
9  0.050582  0.714160  0.168839  0.899230  0.359690  0.438500

通用示例：

new_order = [3,2,1,4,5,0]
print(df[df.columns[new_order]])  

          3         2         1         4      mean         0
0  0.575223  0.719802  0.361846  0.449205  0.500678  0.397312
1  0.584221  0.992154  0.522337  0.042739  0.485741  0.287256
2  0.167698  0.149296  0.464172  0.793634  0.491923  0.884812
3  0.862769  0.046006  0.500179  0.651065  0.543382  0.656891
4  0.468954  0.438760  0.223489  0.308509  0.422683  0.673702
5  0.572475  0.100932  0.093050  0.416471  0.389390  0.764020
6  0.556980  0.626101  0.248186  0.559413  0.449972  0.259181
7  0.308755  0.096072  0.075461  0.157078  0.207592  0.400591
8  0.997547  0.340573  0.368987  0.011892  0.471749  0.639745
9  0.899230  0.168839  0.714160  0.359690  0.438500  0.050582

虽然看起来我只是以不同的顺序显式键入列名，但列“mean”的事实应该清楚地表明，new_order与实际位置相关，而不是列名。

对于OP问题的具体情况：

new_order = [-1,0,1,2,3,4]
df = df[df.columns[new_order]]
print(df)

       mean         0         1         2         3         4
0  0.500678  0.397312  0.361846  0.719802  0.575223  0.449205
1  0.485741  0.287256  0.522337  0.992154  0.584221  0.042739
2  0.491923  0.884812  0.464172  0.149296  0.167698  0.793634
3  0.543382  0.656891  0.500179  0.046006  0.862769  0.651065
4  0.422683  0.673702  0.223489  0.438760  0.468954  0.308509
5  0.389390  0.764020  0.093050  0.100932  0.572475  0.416471
6  0.449972  0.259181  0.248186  0.626101  0.556980  0.559413
7  0.207592  0.400591  0.075461  0.096072  0.308755  0.157078
8  0.471749  0.639745  0.368987  0.340573  0.997547  0.011892
9  0.438500  0.050582  0.714160  0.168839  0.899230  0.359690

这种方法的主要问题是多次调用同一代码将每次产生不同的结果，因此需要小心：）

2018-08-20 17:35:46

import numpy as np
import pandas as pd
df = pd.DataFrame()
column_names = ['x','y','z','mean']
for col in column_names: 
    df[col] = np.random.randint(0,100, size=10000)

您可以尝试以下解决方案：

解决方案1：

df = df[ ['mean'] + [ col for col in df.columns if col != 'mean' ] ]

解决方案2：

df = df[['mean', 'x', 'y', 'z']]

解决方案3：

col = df.pop("mean")
df = df.insert(0, col.name, col)

解决方案4：

df.set_index(df.columns[-1], inplace=True)
df.reset_index(inplace=True)

解决方案5：

cols = list(df)
cols = [cols[-1]] + cols[:-1]
df = df[cols]

解决方案6：

order = [1,2,3,0] # setting column's order
df = df[[df.columns[i] for i in order]]

时间比较：

解决方案1：

CPU时间：用户1.05 ms，sys:35µs，总计：1.08 ms壁时间：995µs

解决方案2：

CPU时间：用户933µs，系统：0 ns，总计：933µ壁时间：800µs

解决方案3：

CPU时间：用户0 ns，sys:1.35 ms，总计：1.35 ms壁时间：1.08 ms

解决方案4：

CPU时间：用户1.23毫秒，系统：45µs，总计：1.27毫秒壁时间：986µs

解决方案5：

CPU时间：用户1.09 ms，系统：19µs，总计：1.11 ms壁时间：949µs

解决方案6：

CPU时间：用户955µs，系统：34µs，总计：989µs壁时间：859µs

2019-11-09 06:24:12

你也可以这样做：

df = df[['mean', '0', '1', '2', '3']]

您可以通过以下方式获取列列表：

cols = list(df.columns.values)

输出将产生：

['0', '1', '2', '3', 'mean']

…然后，在将其放入第一个函数之前，可以手动重新排列

2014-05-19 15:20:33

我想在一个数据帧前面加上两列，我不知道所有列的确切名称，因为它们是从之前的pivot语句生成的。所以，如果你也遇到同样的情况：把你知道名字的列放在前面，然后让它们跟着“所有其他列”，我提出了以下一般解决方案：

df = df.reindex_axis(['Col1','Col2'] + list(df.columns.drop(['Col1','Col2'])), axis=1)

2017-07-27 09:21:39

一种简单的方法是用列列表重新分配数据帧，根据需要重新排列。

这就是你现在拥有的：

In [6]: df
Out[6]:
          0         1         2         3         4      mean
0  0.445598  0.173835  0.343415  0.682252  0.582616  0.445543
1  0.881592  0.696942  0.702232  0.696724  0.373551  0.670208
2  0.662527  0.955193  0.131016  0.609548  0.804694  0.632596
3  0.260919  0.783467  0.593433  0.033426  0.512019  0.436653
4  0.131842  0.799367  0.182828  0.683330  0.019485  0.363371
5  0.498784  0.873495  0.383811  0.699289  0.480447  0.587165
6  0.388771  0.395757  0.745237  0.628406  0.784473  0.588529
7  0.147986  0.459451  0.310961  0.706435  0.100914  0.345149
8  0.394947  0.863494  0.585030  0.565944  0.356561  0.553195
9  0.689260  0.865243  0.136481  0.386582  0.730399  0.561593

In [7]: cols = df.columns.tolist()

In [8]: cols
Out[8]: [0L, 1L, 2L, 3L, 4L, 'mean']

按任意方式重新排列列。这是我将最后一个元素移动到第一个位置的方式：

In [12]: cols = cols[-1:] + cols[:-1]

In [13]: cols
Out[13]: ['mean', 0L, 1L, 2L, 3L, 4L]

然后重新排序数据帧，如下所示：

In [16]: df = df[cols]  #    OR    df = df.ix[:, cols]

In [17]: df
Out[17]:
       mean         0         1         2         3         4
0  0.445543  0.445598  0.173835  0.343415  0.682252  0.582616
1  0.670208  0.881592  0.696942  0.702232  0.696724  0.373551
2  0.632596  0.662527  0.955193  0.131016  0.609548  0.804694
3  0.436653  0.260919  0.783467  0.593433  0.033426  0.512019
4  0.363371  0.131842  0.799367  0.182828  0.683330  0.019485
5  0.587165  0.498784  0.873495  0.383811  0.699289  0.480447
6  0.588529  0.388771  0.395757  0.745237  0.628406  0.784473
7  0.345149  0.147986  0.459451  0.310961  0.706435  0.100914
8  0.553195  0.394947  0.863494  0.585030  0.565944  0.356561
9  0.561593  0.689260  0.865243  0.136481  0.386582  0.730399

2012-10-30 22:38:49

如何更改DataFrame列的顺序？

推荐文章

最新文章

标签