我已经创建了一个熊猫数据框架

df = DataFrame(index=['A','B','C'], columns=['x','y'])

得到了这个

    x    y
A  NaN  NaN
B  NaN  NaN
C  NaN  NaN

现在,我想给特定的单元格赋值,例如给C行和x列赋值。 我希望得到这样的结果:

    x    y
A  NaN  NaN
B  NaN  NaN
C  10  NaN

下面的代码:

df.xs('C')['x'] = 10

但是df的内容没有改变。数据帧仍然只包含nan。

有什么建议吗?


当前回答

在我的例子中,我只是在选定单元格中更改它

    for index, row in result.iterrows():
        if np.isnan(row['weight']):
            result.at[index, 'weight'] = 0.0

'result'是一个带列'weight'的数据字段

其他回答

避免使用链式索引赋值

您正在处理带有链式索引的赋值,这将导致SettingWithCopy警告。无论如何都要避免这种情况。

你的作业将不得不诉诸于一个单独的.loc[]或.iloc[]片,正如这里解释的那样。因此,在你的情况下:

df.loc['C', 'x'] = 10

这是唯一对我有效的方法!

df.loc['C', 'x'] = 10

在这里了解有关.loc的更多信息。

RukTech的答案是df。set_value('C', 'x', 10)比我下面建议的选项快得多。然而,它已被弃用。

接下来,推荐的方法是.iat/.at。


为什么df.xs('C')['x']=10无效:

df.xs('C')在默认情况下返回一个新的数据框架,其中包含数据的副本,因此

df.xs('C')['x']=10

只修改这个新的数据帧。

Df ['x']返回Df数据框架的视图,因此

df['x']['C'] = 10

修改df本身。

警告:有时很难预测一个操作返回的是一个副本还是一个视图。出于这个原因,文档建议避免使用“链式索引”进行赋值。


所以建议的替代方案是

df.at['C', 'x'] = 10

它改变了df。


In [18]: %timeit df.set_value('C', 'x', 10)
100000 loops, best of 3: 2.9 µs per loop

In [20]: %timeit df['x']['C'] = 10
100000 loops, best of 3: 6.31 µs per loop

In [81]: %timeit df.at['C', 'x'] = 10
100000 loops, best of 3: 9.2 µs per loop

df.loc [' c ', ' x '] = 10 这将改变第c行和 xth列。

已弃用Set_value()。

从0.23.4版本开始,Pandas“宣布了未来”…

>>> df
                   Cars  Prices (U$)
0               Audi TT        120.0
1 Lamborghini Aventador        245.0
2      Chevrolet Malibu        190.0
>>> df.set_value(2, 'Prices (U$)', 240.0)
__main__:1: FutureWarning: set_value is deprecated and will be removed in a future release.
Please use .at[] or .iat[] accessors instead

                   Cars  Prices (U$)
0               Audi TT        120.0
1 Lamborghini Aventador        245.0
2      Chevrolet Malibu        240.0

考虑到这些建议,以下是如何使用它们的演示:

按行/列整数位置


>>> df.iat[1, 1] = 260.0
>>> df
                   Cars  Prices (U$)
0               Audi TT        120.0
1 Lamborghini Aventador        260.0
2      Chevrolet Malibu        240.0

通过行/列标签


>>> df.at[2, "Cars"] = "Chevrolet Corvette"
>>> df
                  Cars  Prices (U$)
0               Audi TT        120.0
1 Lamborghini Aventador        260.0
2    Chevrolet Corvette        240.0

引用:

pandas.DataFrame.iat pandas.DataFrame.at