替换pandas数据框架中的列值

我试图替换一个数据框架的一列的值。列('female')只包含值'female'和'male'。

我尝试过以下方法:

w['female']['female']='1'
w['female']['male']='0'

但收到的是与之前结果完全相同的副本。

理想情况下，我希望得到类似于以下循环元素的输出。

if w['female'] =='female':
    w['female'] = '1';
else:
    w['female'] = '0';

我已经查看了gotchas文档(http://pandas.pydata.org/pandas-docs/stable/gotchas.html)，但不明白为什么什么都没有发生。

任何帮助都将不胜感激。

当前回答

我认为，在答案应该指出哪种类型的对象，你得到的所有方法上面建议:它是系列或数据帧。

当你看到w。female的专栏。或者w[[2]](其中，假设2是你的列的数字)，你会得到DataFrame。在这种情况下，你可以使用DataFrame方法，比如。replace。

当你使用。loc或iloc时，你会返回Series，而Series没有。replace方法，所以你应该使用apply, map等方法。

2018-10-15 11:43:56

其他回答

w.replace({'female':{'female':1, 'male':0}}, inplace = True)

上面的代码将把'female'替换为1，'male'替换为0，仅在'female'列中

2020-12-24 12:25:34

pandas中还有一个叫做factorize的函数，您可以使用它自动完成这类工作。它将标签转换为数字:['male'， 'female'， 'male'] ->[0,1,0]。更多信息请看这个答案。

2017-11-18 14:54:30

这也可以工作:

w.female[w.female == 'female'] = 1 
w.female[w.female == 'male']   = 0

2016-08-19 20:35:18

使用系列。使用Series.fillna映射

如果您的列包含的字符串多于female和male，则Series。map在这种情况下将失败，因为它将为其他值返回NaN。

这就是为什么我们要用fillna来连接它

.map失败的例子:

df = pd.DataFrame({'female':['male', 'female', 'female', 'male', 'other', 'other']})

   female
0    male
1  female
2  female
3    male
4   other
5   other

df['female'].map({'female': '1', 'male': '0'})

0      0
1      1
2      1
3      0
4    NaN
5    NaN
Name: female, dtype: object

对于正确的方法，我们使用fillna进行链映射，所以我们用原始列的值填充NaN:

df['female'].map({'female': '1', 'male': '0'}).fillna(df['female'])

0        0
1        1
2        1
3        0
4    other
5    other
Name: female, dtype: object

2020-01-27 18:08:54

dic = {'female':1, 'male':0}
w['female'] = w['female'].replace(dic)

.replace有一个字典作为参数，在这个字典中你可以做任何你想要或需要的事情。

2020-09-27 22:52:01

替换pandas数据框架中的列值

推荐文章

最新文章

标签