使用index为pandas数据框架中的特定单元格设置值

我已经创建了一个熊猫数据框架

df = DataFrame(index=['A','B','C'], columns=['x','y'])

得到了这个

    x    y
A  NaN  NaN
B  NaN  NaN
C  NaN  NaN

现在，我想给特定的单元格赋值，例如给C行和x列赋值。我希望得到这样的结果:

    x    y
A  NaN  NaN
B  NaN  NaN
C  10  NaN

下面的代码:

df.xs('C')['x'] = 10

但是df的内容没有改变。数据帧仍然只包含nan。

有什么建议吗?

当前回答

我测试了，输出是df。Set_value稍微快一点，但官方方法df。At看起来是最快的非弃用的方法。

import numpy as np
import pandas as pd

df = pd.DataFrame(np.random.rand(100, 100))

%timeit df.iat[50,50]=50 # ✓
%timeit df.at[50,50]=50 #  ✔
%timeit df.set_value(50,50,50) # will deprecate
%timeit df.iloc[50,50]=50
%timeit df.loc[50,50]=50

7.06 µs ± 118 ns per loop (mean ± std. dev. of 7 runs, 100000 loops each)
5.52 µs ± 64.2 ns per loop (mean ± std. dev. of 7 runs, 100000 loops each)
3.68 µs ± 80.8 ns per loop (mean ± std. dev. of 7 runs, 100000 loops each)
98.7 µs ± 1.07 µs per loop (mean ± std. dev. of 7 runs, 10000 loops each)
109 µs ± 1.42 µs per loop (mean ± std. dev. of 7 runs, 10000 loops each)

注意，这是为单个单元格设置值。对于向量来说，loc和iloc应该是更好的选择，因为它们是向量化的。

2019-05-07 14:05:42

其他回答

已弃用Set_value()。

从0.23.4版本开始，Pandas“宣布了未来”…

>>> df
                   Cars  Prices (U$)
0               Audi TT        120.0
1 Lamborghini Aventador        245.0
2      Chevrolet Malibu        190.0
>>> df.set_value(2, 'Prices (U$)', 240.0)
__main__:1: FutureWarning: set_value is deprecated and will be removed in a future release.
Please use .at[] or .iat[] accessors instead

                   Cars  Prices (U$)
0               Audi TT        120.0
1 Lamborghini Aventador        245.0
2      Chevrolet Malibu        240.0

考虑到这些建议，以下是如何使用它们的演示:

按行/列整数位置

>>> df.iat[1, 1] = 260.0
>>> df
                   Cars  Prices (U$)
0               Audi TT        120.0
1 Lamborghini Aventador        260.0
2      Chevrolet Malibu        240.0

通过行/列标签

>>> df.at[2, "Cars"] = "Chevrolet Corvette"
>>> df
                  Cars  Prices (U$)
0               Audi TT        120.0
1 Lamborghini Aventador        260.0
2    Chevrolet Corvette        240.0

引用:

pandas.DataFrame.iat pandas.DataFrame.at

2019-02-07 04:19:32

RukTech的答案是df。set_value('C'， 'x'， 10)比我下面建议的选项快得多。然而，它已被弃用。

接下来，推荐的方法是.iat/.at。

为什么df.xs('C')['x']=10无效:

df.xs('C')在默认情况下返回一个新的数据框架，其中包含数据的副本，因此

df.xs('C')['x']=10

只修改这个新的数据帧。

Df ['x']返回Df数据框架的视图，因此

df['x']['C'] = 10

修改df本身。

警告:有时很难预测一个操作返回的是一个副本还是一个视图。出于这个原因，文档建议避免使用“链式索引”进行赋值。

所以建议的替代方案是

df.at['C', 'x'] = 10

它改变了df。

In [18]: %timeit df.set_value('C', 'x', 10)
100000 loops, best of 3: 2.9 µs per loop

In [20]: %timeit df['x']['C'] = 10
100000 loops, best of 3: 6.31 µs per loop

In [81]: %timeit df.at['C', 'x'] = 10
100000 loops, best of 3: 9.2 µs per loop

2012-12-12 14:51:02

苏，你的问题是将['x'，C]的NaN转换为值10

答案是…

df['x'].loc['C':]=10
df

另一种代码是

df.loc['C', 'x']=10
df

2020-02-07 11:27:26

你可以使用。iloc。

df.iloc[[2], [0]] = 10

2017-06-28 15:39:03

我建议:

df.loc[index_position, "column_name"] = some_value

同时修改多个单元格:

df。loc[start_idx_pos: End_idx_pos， "column_name"] = some_value . loc[start_idx_pos: End_idx_pos， "column_name"] = some_value

2020-12-15 23:15:18

使用index为pandas数据框架中的特定单元格设置值

推荐文章

最新文章

标签