周围有一些数据结构非常有用,但大多数程序员都不知道。他们是哪一个?

每个人都知道链表、二叉树和散列,但比如Skip列表和Bloom过滤器。我想知道更多不太常见但值得了解的数据结构,因为它们依赖于伟大的想法,丰富了程序员的工具箱。

PS:我还对舞蹈链接等技术感兴趣,这些技术巧妙地利用了通用数据结构的财产。

编辑:请尝试包含更详细描述数据结构的页面链接。此外,试着补充几句关于数据结构为什么很酷的话(正如乔纳斯·Kölker已经指出的那样)。此外,尝试为每个答案提供一个数据结构。这将允许更好的数据结构仅根据其投票结果浮到顶部。


当前回答

Van Emde Boas树。我甚至有一个C++实现,最多支持2^20个整数。

其他回答

不连续集合森林允许快速的成员查询和联合操作,并且最著名的是在Kruskal的最小生成树算法中使用。

真正酷的是,这两种操作都按阿克曼函数的倒数比例摊销了运行时间,这使其成为“最快”的非恒定时间数据结构。

成对堆是一种堆数据结构,具有相对简单的实现和出色的实际摊余性能。

跳过列表非常整洁。

维基百科跳过列表是一种概率数据结构,基于多个并行、排序的链接列表,其效率与二进制搜索树相当(大多数操作的顺序日志n平均时间)。

它们可以作为平衡树的替代(使用概率平衡而不是严格执行平衡)。它们很容易实现,而且比红黑树更快。我认为他们应该在每一个优秀的程序员工具箱中。

如果你想深入了解跳过列表,这里有一个麻省理工学院算法简介讲座视频的链接。

此外,这里还有一个Java小程序,直观地演示了跳过列表。

二项式堆有很多有趣的财产,其中最有用的是合并。

斐波那契堆

它们被用于一些已知的最快算法(渐近)中,用于许多与图相关的问题,例如最短路径问题。Dijkstra的算法在标准二进制堆的O(E log V)时间内运行;使用斐波那契堆将其提高到O(E+V log V),这对于密集图来说是一个巨大的加速。然而,不幸的是,它们有一个很高的恒定因子,往往使它们在实践中不切实际。