Pandas中map、applymap和应用方法的区别

你能告诉我什么时候使用这些矢量化方法和基本的例子吗?

我看到map是一个系列方法，而其余的是DataFrame方法。我对apply和applymap方法感到困惑。为什么我们有两个方法来应用一个函数到一个数据帧?再一次，简单的例子说明用法将是伟大的!

当前回答

我只是想指出一点，我在这方面有过一些挣扎

def f(x):
    if x < 0:
        x = 0
    elif x > 100000:
        x = 100000
    return x

df.applymap(f)
df.describe()

这不会修改数据帧本身，必须重新分配:

df = df.applymap(f)
df.describe()

2015-09-26 01:30:24

其他回答

除了其他答案，在一个系列中还有map和apply。

Apply可以从一个系列中生成一个DataFrame;然而，map只会在另一个系列的每个单元格中放入一个系列，这可能不是您想要的。

In [40]: p=pd.Series([1,2,3])
In [41]: p
Out[31]:
0    1
1    2
2    3
dtype: int64

In [42]: p.apply(lambda x: pd.Series([x, x]))
Out[42]: 
   0  1
0  1  1
1  2  2
2  3  3

In [43]: p.map(lambda x: pd.Series([x, x]))
Out[43]: 
0    0    1
1    1
dtype: int64
1    0    2
1    2
dtype: int64
2    0    3
1    3
dtype: int64
dtype: object

另外，如果我有一个带有副作用的函数，比如“连接到web服务器”，为了清晰起见，我可能会使用apply。

series.apply(download_file_for_every_element)

Map不仅可以使用函数，还可以使用字典或其他系列。假设你想操纵排列。

Take

1 2 3 4 5
2 1 4 5 3

这个排列的平方是

1 2 3 4 5
1 2 5 3 4

你可以用map来计算。不确定self-application是否有文档记录，但它在0.15.1中可以工作。

In [39]: p=pd.Series([1,0,3,4,2])

In [40]: p.map(p)
Out[40]: 
0    0
1    1
2    4
3    2
4    3
dtype: int64

2014-12-08 23:30:11

我只是想指出一点，我在这方面有过一些挣扎

def f(x):
    if x < 0:
        x = 0
    elif x > 100000:
        x = 100000
    return x

df.applymap(f)
df.describe()

这不会修改数据帧本身，必须重新分配:

df = df.applymap(f)
df.describe()

2015-09-26 01:30:24

apply和applymap之间的区别可能是最简单的解释:

Apply将整个列作为参数，然后将结果分配给该列

Applymap将单独的单元格值作为参数，并将结果分配回该单元格。

注意:如果apply返回单个值，你将得到这个值而不是赋值后的列，最终将只有一行而不是矩阵。

2016-05-20 02:10:04

apply工作在数据帧的行/列基础上 applymap在DataFrame上按元素工作 map在Series上按元素工作

直接摘自Wes McKinney的Python for Data Analysis一书，第132页(我强烈推荐这本书):

另一个常见操作是将一维数组上的函数应用到每一列或行。DataFrame的apply方法是这样做的:

In [116]: frame = DataFrame(np.random.randn(4, 3), columns=list('bde'), index=['Utah', 'Ohio', 'Texas', 'Oregon'])

In [117]: frame
Out[117]: 
               b         d         e
Utah   -0.029638  1.081563  1.280300
Ohio    0.647747  0.831136 -1.549481
Texas   0.513416 -0.884417  0.195343
Oregon -0.485454 -0.477388 -0.309548

In [118]: f = lambda x: x.max() - x.min()

In [119]: frame.apply(f)
Out[119]: 
b    1.133201
d    1.965980
e    2.829781
dtype: float64

许多最常见的数组统计(如sum和mean)是DataFrame方法，所以没有必要使用apply。

也可以使用元素级Python函数。假设您希望从帧中的每个浮点值计算一个格式化字符串。你可以用applymap:

In [120]: format = lambda x: '%.2f' % x

In [121]: frame.applymap(format)
Out[121]: 
            b      d      e
Utah    -0.03   1.08   1.28
Ohio     0.65   0.83  -1.55
Texas    0.51  -0.88   0.20
Oregon  -0.49  -0.48  -0.31

命名为applymap的原因是Series有一个map方法用于应用一个按元素划分的函数:

In [122]: frame['e'].map(format)
Out[122]: 
Utah       1.28
Ohio      -1.55
Texas      0.20
Oregon    -0.31
Name: e, dtype: object

2013-11-05 20:40:33

@jeremiahbuddha提到apply适用于行/列，而applymap适用于元素。但似乎仍然可以使用apply进行元素计算....

frame.apply(np.sqrt)
Out[102]: 
               b         d         e
Utah         NaN  1.435159       NaN
Ohio    1.098164  0.510594  0.729748
Texas        NaN  0.456436  0.697337
Oregon  0.359079       NaN       NaN

frame.applymap(np.sqrt)
Out[103]: 
               b         d         e
Utah         NaN  1.435159       NaN
Ohio    1.098164  0.510594  0.729748
Texas        NaN  0.456436  0.697337
Oregon  0.359079       NaN       NaN

2013-12-19 17:21:38

Pandas中map、applymap和应用方法的区别

推荐文章

最新文章

标签