周围有一些数据结构非常有用,但大多数程序员都不知道。他们是哪一个?

每个人都知道链表、二叉树和散列,但比如Skip列表和Bloom过滤器。我想知道更多不太常见但值得了解的数据结构,因为它们依赖于伟大的想法,丰富了程序员的工具箱。

PS:我还对舞蹈链接等技术感兴趣,这些技术巧妙地利用了通用数据结构的财产。

编辑:请尝试包含更详细描述数据结构的页面链接。此外,试着补充几句关于数据结构为什么很酷的话(正如乔纳斯·Kölker已经指出的那样)。此外,尝试为每个答案提供一个数据结构。这将允许更好的数据结构仅根据其投票结果浮到顶部。


当前回答

我认为保罗·费拉吉纳和乔凡尼·曼奇尼的FM指数真的很酷。尤其是在生物信息学方面。它本质上是一个压缩的全文索引,利用了后缀数组和参考文本的burrows-wheeler变换的组合。可以在不解压缩整个索引的情况下搜索索引。

其他回答

向左倾斜的红黑树。罗伯特·塞奇威克(Robert Sedgewick)于2008年发表的红黑树的一个显著简化的实现(大约是要实现的代码行的一半)。如果您在红黑树的实现方面遇到过困难,请阅读此变体。

与安德森树非常相似(如果不是完全相同)。

Hinze和Paterson的2-3手指树是一种功能强大的数据结构瑞士军刀,具有很好的渐近线,适用于各种操作。虽然复杂,但它们比之前的Kaplan和Tarjan通过递归减速实现的持久列表的命令式结构简单得多。

它们作为一个可链接的deque,O(1)访问任意一端,O(log-min(n,m))追加,并提供O(log-main(n),length-n))索引,直接访问序列的任何部分上的单形前缀和。

实现存在于Haskell、Coq、F#、Scala、Java、C、Clojure、C#和其他语言中。

您可以使用它们来实现优先级搜索队列、区间映射、具有快速头部访问的绳索、映射、集合、可链接序列或几乎任何结构,您可以将其表述为在快速可链接/可索引序列上收集单形结果。

我还有一些幻灯片描述了它们的派生和使用。

min-max堆是实现双端优先级队列的堆的变体。它通过简单地更改堆属性来实现这一点:如果偶数(奇数)级别上的每个元素都小于(大于)所有子级和孙子级,则称树为最小-最大排序。级别从1开始编号。

http://internet512.chonbuk.ac.kr/datastructure/heap/img/heap8.jpg

我真的很喜欢间隔树。它们允许您获取一组时间间隔(即开始/结束时间或其他时间),并查询哪些时间间隔包含给定时间,或哪些时间间隔在给定时间段内“活动”。查询可以在O(log n)中完成,预处理是O(n log n)。

直角三角形网络(RTIN)

非常简单的自适应细分网格的方法。拆分和合并操作只需要几行代码。