第一章:数据结构和算法

1.4 查找最大或最小的N个元素

问题:

怎样从一个集合中获得最大或者最小的 N 个元素列表?

解决方案:

heapq 模块有两个函数:nlargest() 和 nsmallest() 可以完美解决这个问题。

>>> import heapq
>>> nums = [1, 8, 2, 23, 7, -4, 18, 23, 42, 37, 2]
>>> print(heapq.nlargest(3, nums))
[42, 37, 23]
>>> print(heapq.nsmallest(3, nums))
[-4, 1, 2]
>>>

另外的,两个函数都能接受一个关键字参数,用于更复杂的数据结构中:

>>> portfolio = [
{'name': 'IBM', 'shares': 100, 'price': 91.1},
{'name': 'AAPL', 'shares': 50, 'price': 543.22},
{'name': 'FB', 'shares': 200, 'price': 21.09},
{'name': 'HPQ', 'shares': 35, 'price': 31.75},
{'name': 'YHOO', 'shares': 45, 'price': 16.35},
{'na... ... ... ... ... ... me': 'ACME', 'shares': 75, 'price': 115.65}
]...
>>> cheap = heapq.nsmallest(3, portfolio, key=lambda s: s['price'])
>>> expensive = heapq.nlargest(3, portfolio, key=lambda s: s['price'])
>>> print(cheap)
[{'name': 'YHOO', 'shares': 45, 'price': 16.35}, {'name': 'FB', 'shares': 200, 'price': 21.09}, {'name': 'HPQ', 'shares': 35, 'price': 31.75}]
>>> print(expensive)
[{'name': 'AAPL', 'shares': 50, 'price': 543.22}, {'name': 'ACME', 'shares': 75, 'price': 115.65}, {'name': 'IBM', 'shares': 100, 'price': 91.1}]
>>>

讨论:

讨论 如果你想在一个集合中查找最小或最大的 N 个元素,并且 N 小于集合元素数量, 那么这些函数提供了很好的性能。因为在底层实现里面,首先会先将集合数据进行堆排 序后放入一个列表中:

>>> nums = [1, 8, 2, 23, 7, -4, 18, 23, 42, 37, 2]
>>> import heapq
>>> heap = list(nums)
>>> heapq.heapify(heap)
>>> heap
[-4, 2, 1, 23, 7, 2, 18, 23, 42, 37, 8]
>>> heapq.heappop(heap)
-4
>>> heapq.heappop(heap)
1
>>> heapq.heappop(heap)
2
>>> heapq.heappop(heap)
2
>>> heapq.heappop(heap)
7
>>>

当要查找的元素个数相对比较小的时候,函数 nlargest() 和 nsmallest() 是很 合适的。如果你仅仅想查找唯一的最小或最大(N=1)的元素的话,那么使用 min() 和 max() 函数会更快些。类似的,如果 N 的大小和集合大小接近的时候,通常先排序这个 集合然后再使用切片操作会更快点(sorted(items)[:N] 或者是 sorted(items)[-N:] )。需要在正确场合使用函数 nlargest() 和 nsmallest() 才能发挥它们的优势(如果 N 快接近集合大小了,那么使用排序操作会更好些)。

最新文章

  1. 一次外企QQ面试
  2. 理解OAuth2.0
  3. [转]走向视网膜(Retina)的Web时代
  4. 代码导出Reporting Services报表文件
  5. 通用权限底层研究:Web应用限制IP访问的功能实现
  6. 控制反转 (inversion of control)
  7. handler.post 为什么要将thread对象post到handler中执行呢?
  8. Python学习_算数运算函数
  9. c语言冒泡排序,指针,数组
  10. Tomcat架构(二)
  11. 基于visual Studio2013解决C语言竞赛题之1023判断排序
  12. 题解:LOJ540游戏
  13. java中的String整理
  14. C++标准模板库(STL)之Stack
  15. SecureCRT常见配置
  16. java中间缓存变量机制
  17. LeetCode(94):二叉树的中序遍历
  18. C#、.Net经典面试题目及答案
  19. 09-04 java 接口
  20. BZOJ 1005: [HNOI2008]明明的烦恼(prufer数列)

热门文章

  1. Datazen自己定义地图
  2. Windows中的时区信息
  3. jquery操作删除元素
  4. Codesys——限定符的使用方法[来自Codesys的Help]
  5. tiny4412 裸机程序 三、关闭看门狗和调用C程序【转】
  6. ajax接收处理json格式数据
  7. U盘在电脑上安装CentOS 7 系统过程详解
  8. [App Store Connect帮助]三、管理 App 和版本(4)创建新版本
  9. AcWing算法基础1.1
  10. 关于swoole 和golang 的压力测试结果