如何从一个集合中获得最大或最小的N个元素列表

如何从一个集合中获得最大或最小的N个元素列表?

模块

heapq模块有两个函数: nlargest()nsmallest() 可以完美解决这个问题

实例

1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
import heapq

nums = [1, 8, 2, 23, 7, -4, 18, 23, 42, 37, 2]
print(nums)
print(max(nums))
print(min(nums))
print(heapq.nlargest(3, nums))
print(heapq.nsmallest(3, nums))
heapq.heapify(nums)
print(nums)

print("pop:%d" % heapq.heappop(nums))
print(nums)
print("pop:%d" % heapq.heappop(nums))
print(nums)

import heapq
portfolio = [
{'name': 'IBM', 'shares': 100, 'price': 91.1},
{'name': 'AAPL', 'shares': 50, 'price': 543.22},
{'name': 'FB', 'shares': 200, 'price': 21.09},
{'name': 'HPQ', 'shares': 35, 'price': 31.75},
{'name': 'YHOO', 'shares': 45, 'price': 16.35},
{'name': 'ACME', 'shares': 75, 'price': 115.65}
]

cheap = heapq.nsmallest(3, portfolio, key=lambda s: s['price'])
expensive = heapq.nlargest(3, portfolio, key=lambda s: s['price'])

print(cheap)
print(expensive)

运行结果

1
2
3
4
5
6
7
8
9
10
11
12
13
C:\Users\liuqi\AppData\Local\Programs\Python\Python37\python.exe F:/python/CODE/Python_cookbook.py
[1, 8, 2, 23, 7, -4, 18, 23, 42, 37, 2]
42
-4
[42, 37, 23]
[-4, 1, 2]
[-4, 2, 1, 23, 7, 2, 18, 23, 42, 37, 8]
pop:-4
[1, 2, 2, 23, 7, 8, 18, 23, 42, 37]
pop:1
[2, 2, 8, 23, 7, 37, 18, 23, 42]
[{'name': 'YHOO', 'shares': 45, 'price': 16.35}, {'name': 'FB', 'shares': 200, 'price': 21.09}, {'name': 'HPQ', 'shares': 35, 'price': 31.75}]
[{'name': 'AAPL', 'shares': 50, 'price': 543.22}, {'name': 'ACME', 'shares': 75, 'price': 115.65}, {'name': 'IBM', 'shares': 100, 'price': 91.1}]

讨论

当要查找的元素个数相对比较小的时候,函数 nlargest()nsmallest()是很合适的。 如果你仅仅想查找唯一的最小或最大(N=1)的元素的话,那么使用min()和max()函数会更 快些。 类似的,如果N的大小和集合大小接近的时候,通常先排序这个集合然后再使用切 片操作会更快点 ( sorted(items)[:N] 或者是 sorted(items)[-N:] )。 需要在正确场合使用函数nlargest()nsmallest()才能发挥它们的优势 (如果N快接近集合大小了,那么使用排 序操作会更好些)。


注:本文使用的实例代码,参考自《python cookbook 第三版》