ValueError:输入包含NaN，无穷大或对dtype('float64')太大的值

我使用sklearn和有一个问题的亲和传播。我已经建立了一个输入矩阵，我一直得到以下错误。

ValueError: Input contains NaN, infinity or a value too large for dtype('float64').

我已经跑了

np.isnan(mat.any()) #and gets False
np.isfinite(mat.all()) #and gets True

我试着用

mat[np.isfinite(mat) == True] = 0

去除掉无限值，但这也没用。我要怎么做才能去掉矩阵中的无穷大值，这样我就可以使用亲和传播算法了?

我使用anaconda和python 2.7.9。

当前回答

使用isneginf可能会有所帮助。 http://docs.scipy.org/doc/numpy/reference/generated/numpy.isneginf.html#numpy.isneginf

x[numpy.isneginf(x)] = 0 #0 is the value you want to replace with

2022-01-02 17:05:59

其他回答

当我使用sklearn与熊猫时，我得到了同样的错误消息。我的解决方案是在运行任何sklearn代码之前重置我的dataframe df的索引:

df = df.reset_index()

在删除df中的一些条目时，我多次遇到这个问题，例如

df = df[df.label=='desired_one']

2017-12-24 03:43:36

这是我的函数(基于此)来清除数据集的nan, Inf和缺失的单元格(用于倾斜的数据集):

import pandas as pd
import numpy as np

def clean_dataset(df):
    assert isinstance(df, pd.DataFrame), "df needs to be a pd.DataFrame"
    df.dropna(inplace=True)
    indices_to_keep = ~df.isin([np.nan, np.inf, -np.inf]).any(axis=1)
    return df[indices_to_keep].astype(np.float64)

2017-10-05 08:30:13

泡芙! !在我的情况下，问题是关于NaN值…

您可以使用此函数列出具有NaN的列

your_data.isnull().sum()

然后你可以在数据集文件中填充这些NAN值。

下面是如何“将NaN替换为零，将无穷大替换为大的有限数”的代码。

your_data[:] = np.nan_to_num(your_data)

从numpy.nan_to_num

2022-04-28 18:04:03

我有同样的问题，在我的情况下，答案很简单，我有一个单元格在我的CSV中没有值(“x,y,z，，”)。把一个默认值固定为我。

2021-12-13 15:29:59

我想为numpy提出一个适合我的解决方案。这条线

from numpy import inf
inputArray[inputArray == inf] = np.finfo(np.float64).max

将numpy数组的所有无限值替换为最大的float64数。

2021-01-01 17:05:45

ValueError:输入包含NaN，无穷大或对dtype('float64')太大的值

推荐文章

最新文章

标签