计算一个值在数据帧列中出现的频率

我有一个数据集

category
cat a
cat b
cat a

我希望能够返回(显示唯一值和频率)

category   freq 
cat a       2
cat b       1

当前回答

df.category.value_counts()

这一小行代码将提供您想要的输出。

如果列名中有空格，则可以使用

df['category'].value_counts()

2018-01-15 17:52:10

其他回答

如果你想应用到所有列，你可以使用:

df.apply(pd.value_counts)

这将对每一列应用一个基于列的聚合函数(在本例中为value_counts)。

2016-04-05 18:30:11

对df中的多个列使用列表理解和value_counts

[my_series[c].value_counts() for c in list(my_series.select_dtypes(include=['O']).columns)]

https://stackoverflow.com/a/28192263/786326

2015-01-28 13:11:04

如果你的DataFrame有相同类型的值，你也可以在numpy.unique()中设置return_counts=True。

index, counts= np.unique(df.values,return_counts=True)

如果您的值是整数，则Np.bincount()可能更快。

2017-10-04 22:06:38

your data:

|category|
cat a
cat b
cat a

解决方案:

 df['freq'] = df.groupby('category')['category'].transform('count')
 df =  df.drop_duplicates()

2019-01-27 07:06:24

如果没有任何库，你可以这样做:

def to_frequency_table(data):
    frequencytable = {}
    for key in data:
        if key in frequencytable:
            frequencytable[key] += 1
        else:
            frequencytable[key] = 1
    return frequencytable

例子:

to_frequency_table([1,1,1,1,2,3,4,4])
>>> {1: 4, 2: 1, 3: 1, 4: 2}

2017-03-27 22:05:15

计算一个值在数据帧列中出现的频率

推荐文章

最新文章

标签