如何计算一个无序列表中元素的频率?

给定一个无序的值列表，比如

a = [5, 1, 2, 2, 4, 3, 1, 2, 3, 1, 1, 5, 2]

我怎样才能得到出现在列表中的每个值的频率，就像这样?

# `a` has 4 instances of `1`, 4 of `2`, 2 of `3`, 1 of `4,` 2 of `5`
b = [4, 4, 2, 1, 2] # expected output

当前回答

下面是使用itertools的另一个简洁的替代方案。Groupby也适用于无序输入:

from itertools import groupby

items = [5, 1, 1, 2, 2, 1, 1, 2, 2, 3, 4, 3, 5]

results = {value: len(list(freq)) for value, freq in groupby(sorted(items))}

结果

format: {value: num_of_occurencies}

{1: 4, 2: 4, 3: 2, 4: 1, 5: 2}

2019-03-31 02:17:50

其他回答

如果列表是排序的，你可以使用itertools标准库中的groupby(如果不是，你可以先排序，尽管这需要O(nlgn)时间):

from itertools import groupby

a = [5, 1, 2, 2, 4, 3, 1, 2, 3, 1, 1, 5, 2]
[len(list(group)) for key, group in groupby(sorted(a))]

输出:

[4, 4, 2, 1, 2]

2010-01-29 12:18:39

还有一种方法是使用字典和列表。数数，下面一种幼稚的做法。

dicio = dict()

a = [1,1,1,1,2,2,2,2,3,3,4,5,5]

b = list()

c = list()

for i in a:

   if i in dicio: continue 

   else:

      dicio[i] = a.count(i)

      b.append(a.count(i))

      c.append(i)

print (b)

print (c)

2017-04-19 19:25:36

你可以这样做:

import numpy as np
a = [1,1,1,1,2,2,2,2,3,3,4,5,5]
np.unique(a, return_counts=True)

输出:

(array([1, 2, 3, 4, 5]), array([4, 4, 2, 1, 2], dtype=int64))

第一个数组是值，第二个数组是具有这些值的元素的数量。

所以如果你想要得到一个数字数组，你应该使用这个:

np.unique(a, return_counts=True)[1]

2017-07-23 18:11:17

下面是使用itertools的另一个简洁的替代方案。Groupby也适用于无序输入:

from itertools import groupby

items = [5, 1, 1, 2, 2, 1, 1, 2, 2, 3, 4, 3, 5]

results = {value: len(list(freq)) for value, freq in groupby(sorted(items))}

结果

format: {value: num_of_occurencies}

{1: 4, 2: 4, 3: 2, 4: 1, 5: 2}

2019-03-31 02:17:50

seta = set(a)
b = [a.count(el) for el in seta]
a = list(seta) #Only if you really want it.

2010-01-29 12:18:15

如何计算一个无序列表中元素的频率?

推荐文章

最新文章

标签