计算一个值在数据帧列中出现的频率

我有一个数据集

category
cat a
cat b
cat a

我希望能够返回(显示唯一值和频率)

category   freq 
cat a       2
cat b       1

当前回答

我相信这应该工作的任何DataFrame列列表。

def column_list(x):
    column_list_df = []
    for col_name in x.columns:
        y = col_name, len(x[col_name].unique())
        column_list_df.append(y)
return pd.DataFrame(column_list_df)

column_list_df.rename(columns={0: "Feature", 1: "Value_count"})

函数“column_list”检查列名，然后检查每个列值的唯一性。

2019-05-02 12:26:36

其他回答

正如大家所说，更快的解决方法是:

df.column_to_analyze.value_counts()

但是如果你想在你的数据框架中使用输出，使用这个模式:

df input:

category
cat a
cat b
cat a

df output: 

category   counts
cat a        2
cat b        1 
cat a        2

你可以这样做:

df['counts'] = df.category.map(df.category.value_counts())
df

2021-08-04 17:09:50

下面的代码为名为“smaller_dat1”的数据帧中的“Total_score”列中的各种值创建频率表，然后返回值“300”在该列中出现的次数。

valuec = smaller_dat1.Total_score.value_counts()
valuec.loc[300]

2021-06-27 20:21:21

df.category.value_counts()

这一小行代码将提供您想要的输出。

如果列名中有空格，则可以使用

df['category'].value_counts()

2018-01-15 17:52:10

你也可以用pandas先把你的列作为类别广播，例如dtype="category"。

cats = ['client', 'hotel', 'currency', 'ota', 'user_country']

df[cats] = df[cats].astype('category')

然后调用describe:

df[cats].describe()

这将给你一个很好的值计数表和更多的东西:):

    client  hotel   currency    ota user_country
count   852845  852845  852845  852845  852845
unique  2554    17477   132 14  219
top 2198    13202   USD Hades   US
freq    102562  8847    516500  242734  340992

2018-05-18 16:08:48

我相信这应该工作的任何DataFrame列列表。

def column_list(x):
    column_list_df = []
    for col_name in x.columns:
        y = col_name, len(x[col_name].unique())
        column_list_df.append(y)
return pd.DataFrame(column_list_df)

column_list_df.rename(columns={0: "Feature", 1: "Value_count"})

函数“column_list”检查列名，然后检查每个列值的唯一性。

2019-05-02 12:26:36

计算一个值在数据帧列中出现的频率

推荐文章

最新文章

标签