使用index为pandas数据框架中的特定单元格设置值

我已经创建了一个熊猫数据框架

df = DataFrame(index=['A','B','C'], columns=['x','y'])

得到了这个

    x    y
A  NaN  NaN
B  NaN  NaN
C  NaN  NaN

现在，我想给特定的单元格赋值，例如给C行和x列赋值。我希望得到这样的结果:

    x    y
A  NaN  NaN
B  NaN  NaN
C  10  NaN

下面的代码:

df.xs('C')['x'] = 10

但是df的内容没有改变。数据帧仍然只包含nan。

有什么建议吗?

当前回答

更新:.set_value方法将被弃用。它们是很好的替代品，不幸的是熊猫提供的文件很少

最快的方法是使用set_value。该方法比.ix方法快100倍。例如:

df。set_value('C'， 'x'， 10)

2014-07-01 19:16:40

其他回答

df.loc [' c ', ' x '] = 10 这将改变第c行和 xth列。

2018-10-07 19:01:45

RukTech的答案是df。set_value('C'， 'x'， 10)比我下面建议的选项快得多。然而，它已被弃用。

接下来，推荐的方法是.iat/.at。

为什么df.xs('C')['x']=10无效:

df.xs('C')在默认情况下返回一个新的数据框架，其中包含数据的副本，因此

df.xs('C')['x']=10

只修改这个新的数据帧。

Df ['x']返回Df数据框架的视图，因此

df['x']['C'] = 10

修改df本身。

警告:有时很难预测一个操作返回的是一个副本还是一个视图。出于这个原因，文档建议避免使用“链式索引”进行赋值。

所以建议的替代方案是

df.at['C', 'x'] = 10

它改变了df。

In [18]: %timeit df.set_value('C', 'x', 10)
100000 loops, best of 3: 2.9 µs per loop

In [20]: %timeit df['x']['C'] = 10
100000 loops, best of 3: 6.31 µs per loop

In [81]: %timeit df.at['C', 'x'] = 10
100000 loops, best of 3: 9.2 µs per loop

2012-12-12 14:51:02

建议的设置方法(根据维护人员)为:

df.ix['x','C']=10

使用“链式索引”(df['x']['C'])可能会导致问题。

See:

https://stackoverflow.com/a/21287235/1579844 http://pandas.pydata.org/pandas-docs/dev/indexing.html#indexing-view-versus-copy https://github.com/pydata/pandas/pull/6031

2014-01-22 15:48:25

.iat /。是很好的解决办法。假设你有这样一个简单的数据帧:

   A   B   C
0  1   8   4 
1  3   9   6
2  22 33  52

如果我们想修改单元格[0，"A"]的值，你可以使用这些解决方案之一:

df。Iat [0,0] = 2 df。at[0，'A'] = 2

下面是一个如何使用iat获取和设置cell值的完整示例:

def prepossessing(df):
  for index in range(0,len(df)): 
      df.iat[index,0] = df.iat[index,0] * 2
  return df

Y_train前:

Y_train调用prepossession函数后，iat改变每个单元格的值乘以2:

2019-04-29 15:33:13

更新:.set_value方法将被弃用。它们是很好的替代品，不幸的是熊猫提供的文件很少

最快的方法是使用set_value。该方法比.ix方法快100倍。例如:

df。set_value('C'， 'x'， 10)

2014-07-01 19:16:40

使用index为pandas数据框架中的特定单元格设置值

推荐文章

最新文章

标签