将Pandas或Numpy Nan替换为None以用于MysqlDB

我试图写一个熊猫数据帧(或可以使用numpy数组)到mysql数据库使用MysqlDB。MysqlDB似乎不理解'nan'，我的数据库抛出一个错误，说nan不在字段列表中。我需要找到一种方法将“nan”转换为NoneType。

什么好主意吗?

当前回答

现在对我来说，徒手做是唯一可行的方法。

@rodney cox的回答几乎在所有情况下都对我有效。

下面的代码将所有列设置为对象数据类型，然后将任何空值替换为None。将列数据类型设置为object非常重要，因为这样可以防止pandas进一步更改类型。

for col in df.columns:
    df[col] = df[col].astype(object)
    df.loc[df[col].isnull(), col] = None

警告:此解决方案效率不高，因为它处理的列可能没有np。nan值。

2022-05-30 16:16:26

其他回答

还有另一个选择，它确实对我有用:

df = df.astype(object).replace(np.nan, None)

2022-03-04 15:35:57

现在对我来说，徒手做是唯一可行的方法。

@rodney cox的回答几乎在所有情况下都对我有效。

下面的代码将所有列设置为对象数据类型，然后将任何空值替换为None。将列数据类型设置为object非常重要，因为这样可以防止pandas进一步更改类型。

for col in df.columns:
    df[col] = df[col].astype(object)
    df.loc[df[col].isnull(), col] = None

警告:此解决方案效率不高，因为它处理的列可能没有np。nan值。

2022-05-30 16:16:26

@bogatron是对的，你可以用where，值得注意的是，你可以在熊猫的原生环境中这样做:

df1 = df.where(pd.notnull(df), None)

注意:这将所有列的dtype更改为object。

例子:

In [1]: df = pd.DataFrame([1, np.nan])

In [2]: df
Out[2]: 
    0
0   1
1 NaN

In [3]: df1 = df.where(pd.notnull(df), None)

In [4]: df1
Out[4]: 
      0
0     1
1  None

注意:你不能做的是重铸DataFrames dtype以允许所有的数据类型，使用astype，然后使用DataFrame fillna方法:

df1 = df.astype(object).replace(np.nan, 'None')

不幸的是，这和使用replace都不能与None一起工作，看到这个(关闭)问题。

顺便说一句，值得注意的是，对于大多数用例，您不需要将NaN替换为None，请参阅这个关于pandas中NaN和None之间差异的问题。

然而，在这个特定的情况下，你似乎是这样的(至少在回答这个问题的时候)。

2013-01-04 19:01:25

经过一番摸索，这招对我很管用:

df = df.astype(object).where(pd.notnull(df),None)

2017-08-02 19:47:59

df = df.replace({np.nan: None})

注意:对于<1.4的pandas版本，这会将所有受影响列的dtype更改为object。为了避免这种情况，请使用以下语法:

df = df.replace(np.nan, None)

这要归功于Github上的这个家伙和Killian Huyghe的评论。

2019-01-28 14:07:22

将Pandas或Numpy Nan替换为None以用于MysqlDB

推荐文章

最新文章

标签