我如何计算在熊猫数据框架一列的NaN值?

我想找出我的数据的每一列中NaN的数量。

当前回答

对于你的任务，你可以使用pandas.DataFrame.dropna (https://pandas.pydata.org/pandas-docs/stable/reference/api/pandas.DataFrame.dropna.html):

import pandas as pd
import numpy as np

df = pd.DataFrame({'a': [1, 2, 3, 4, np.nan],
                   'b': [1, 2, np.nan, 4, np.nan],
                   'c': [np.nan, 2, np.nan, 4, np.nan]})
df = df.dropna(axis='columns', thresh=3)

print(df)

使用thresh参数，您可以声明DataFrame中所有列的NaN值的最大计数。

代码输出:

     a    b
0  1.0  1.0
1  2.0  2.0
2  3.0  NaN
3  4.0  4.0
4  NaN  NaN

2020-01-20 14:58:51

其他回答

另一个尚未被建议的简单选项是，为了只计算NaN，将在形状中添加以返回具有NaN的行数。

df[df['col_name'].isnull()]['col_name'].shape

2019-04-22 19:57:13

请使用以下方法计算特定的列数

dataframe.columnName.isnull().sum()

2019-11-28 08:15:27

自从pandas 0.14.1以来，我的建议在value_counts方法中有一个关键字参数已经实现:

import pandas as pd
df = pd.DataFrame({'a':[1,2,np.nan], 'b':[np.nan,1,np.nan]})
for col in df:
    print df[col].value_counts(dropna=False)

2     1
 1     1
NaN    1
dtype: int64
NaN    2
 1     1
dtype: int64

2014-10-09 07:14:27

使用isna()方法(或者它的别名isnull()，这也兼容较旧的pandas版本< 0.21.0)，然后求和来计算NaN值。其中一列:

>>> s = pd.Series([1,2,3, np.nan, np.nan])

>>> s.isna().sum()   # or s.isnull().sum() for older pandas versions
2

对于一些列，这也适用:

>>> df = pd.DataFrame({'a':[1,2,np.nan], 'b':[np.nan,1,np.nan]})

>>> df.isna().sum()
a    1
b    2
dtype: int64

2014-10-08 21:06:28

df1.isnull().sum()

这样就可以了。

2018-05-13 12:25:54

我如何计算在熊猫数据框架一列的NaN值?

推荐文章

最新文章

标签