在Pandas中重命名列名

我想从

['$a', '$b', '$c', '$d', '$e']

['a', 'b', 'c', 'd', 'e']

当前回答

这里有一个我喜欢用来减少打字的漂亮小函数：

def rename(data, oldnames, newname):
    if type(oldnames) == str: # Input can be a string or list of strings
        oldnames = [oldnames] # When renaming multiple columns
        newname = [newname] # Make sure you pass the corresponding list of new names
    i = 0
    for name in oldnames:
        oldvar = [c for c in data.columns if name in c]
        if len(oldvar) == 0:
            raise ValueError("Sorry, couldn't find that column in the dataset")
        if len(oldvar) > 1: # Doesn't have to be an exact match
            print("Found multiple columns that matched " + str(name) + ": ")
            for c in oldvar:
                print(str(oldvar.index(c)) + ": " + str(c))
            ind = input('Please enter the index of the column you would like to rename: ')
            oldvar = oldvar[int(ind)]
        if len(oldvar) == 1:
            oldvar = oldvar[0]
        data = data.rename(columns = {oldvar : newname[i]})
        i += 1
    return data

下面是一个如何工作的示例：

In [2]: df = pd.DataFrame(np.random.randint(0, 10, size=(10, 4)), columns = ['col1', 'col2', 'omg', 'idk'])
# First list = existing variables
# Second list = new names for those variables
In [3]: df = rename(df, ['col', 'omg'],['first', 'ohmy'])
Found multiple columns that matched col:
0: col1
1: col2

Please enter the index of the column you would like to rename: 0

In [4]: df.columns
Out[5]: Index(['first', 'col2', 'ohmy', 'idk'], dtype='object')

2018-04-19 07:48:53

其他回答

许多panda函数都有一个就地参数。当设置为True时，转换将直接应用于调用它的数据帧。例如：

df = pd.DataFrame({'$a':[1,2], '$b': [3,4]})
df.rename(columns={'$a': 'a'}, inplace=True)
df.columns

>>> Index(['a', '$b'], dtype='object')

或者，在某些情况下，您希望保留原始数据帧。如果创建数据帧是一项昂贵的任务，我经常看到人们陷入这种情况。例如，如果创建数据帧需要查询雪花数据库。在这种情况下，只需确保将inplace参数设置为False。

df = pd.DataFrame({'$a':[1,2], '$b': [3,4]})
df2 = df.rename(columns={'$a': 'a'}, inplace=False)
df.columns

>>> Index(['$a', '$b'], dtype='object')

df2.columns

>>> Index(['a', '$b'], dtype='object')

如果这些类型的转换是您经常做的，那么您还可以研究一些不同的panda GUI工具。我是一个叫做水户的人的创造者。它是一个电子表格，可以自动将您的编辑转换为python代码。

2021-06-15 00:38:13

列名与系列名称

我想解释一下幕后发生的事情。

数据帧是一组系列。

序列又是numpy.array的扩展。

numpy.arrays具有属性.name。

这是系列的名称。熊猫很少尊重这个属性，但它会在某些地方停留，可以用来攻击熊猫的一些行为。

命名列列表

这里有很多答案谈到df.columns属性是一个列表，而实际上它是一个系列。这意味着它具有.name属性。

如果您决定填写列的名称“系列：

df.columns = ['column_one', 'column_two']
df.columns.names = ['name of the list of columns']
df.index.names = ['name of the index']

name of the list of columns     column_one  column_two
name of the index
0                                    4           1
1                                    5           2
2                                    6           3

请注意，索引的名称总是低一列。

挥之不去的艺术事实

.name属性有时会持续存在。如果将df.columns设置为['one'，'two']，则df.one.name将为'one'。

如果您将df.one.name设置为'three'，则df.columns仍然会给您['one'，'two']，df.one.name会给您'three]。

BUT

pd.DataFrame（df.one）将返回

因为Pandas重用已经定义的Series的.name。

多级列名

Pandas有多种方法来实现多层列名。这里面没有太多魔法，但我想在我的回答中也包括这一点，因为我没有看到任何人在这里学习这一点。

    |one            |
    |one      |two  |
0   |  4      |  1  |
1   |  5      |  2  |
2   |  6      |  3  |

通过将列设置为列表，这很容易实现，如下所示：

df.columns = [['one', 'one'], ['one', 'two']]

2016-09-29 12:30:40

如果您只想删除“$”符号，请使用以下代码

df.columns = pd.Series(df.columns.str.replace("$", ""))

2021-03-19 10:29:52

假设这是您的数据帧。

可以使用两种方法重命名列。

使用dataframe.columns=[#list]df.columns=[‘a’，‘b’，‘c’，‘d’，‘e’]此方法的限制是，如果必须更改一列，则必须传递完整的列列表。此外，此方法不适用于索引标签。例如，如果您通过以下步骤：df.columns=[‘a’、‘b’、‘c’、‘d’]这将引发错误。长度不匹配：预期轴有5个元素，新值有4个元素。另一种方法是Pandasrename（）方法，用于重命名任何索引、列或行df=df.rename（列=｛‘$a‘：‘a‘｝）

同样，您可以更改任何行或列。

2019-08-27 08:30:27

由于您只想删除所有列名中的$符号，因此只需执行以下操作：

df = df.rename(columns=lambda x: x.replace('$', ''))

df.rename(columns=lambda x: x.replace('$', ''), inplace=True)

2014-03-26 10:20:45

在Pandas中重命名列名

推荐文章

最新文章

标签