周围有一些数据结构非常有用,但大多数程序员都不知道。他们是哪一个?

每个人都知道链表、二叉树和散列,但比如Skip列表和Bloom过滤器。我想知道更多不太常见但值得了解的数据结构,因为它们依赖于伟大的想法,丰富了程序员的工具箱。

PS:我还对舞蹈链接等技术感兴趣,这些技术巧妙地利用了通用数据结构的财产。

编辑:请尝试包含更详细描述数据结构的页面链接。此外,试着补充几句关于数据结构为什么很酷的话(正如乔纳斯·Kölker已经指出的那样)。此外,尝试为每个答案提供一个数据结构。这将允许更好的数据结构仅根据其投票结果浮到顶部。


当前回答

跳过列表非常整洁。

维基百科跳过列表是一种概率数据结构,基于多个并行、排序的链接列表,其效率与二进制搜索树相当(大多数操作的顺序日志n平均时间)。

它们可以作为平衡树的替代(使用概率平衡而不是严格执行平衡)。它们很容易实现,而且比红黑树更快。我认为他们应该在每一个优秀的程序员工具箱中。

如果你想深入了解跳过列表,这里有一个麻省理工学院算法简介讲座视频的链接。

此外,这里还有一个Java小程序,直观地演示了跳过列表。

其他回答

三元搜索树

快速前缀搜索(用于增量自动完成等)部分匹配(当您想查找字符串X汉明距离内的所有单词时)通配符搜索

很容易实施。

我喜欢缓存不可见的数据结构。其基本思想是以递归更小的块来布局树,以便许多不同大小的缓存可以利用适合它们的块。这导致了从RAM中的L1缓存到从磁盘读取的大块数据的所有缓存的高效使用,而无需了解任何缓存层的大小细节。

Arne Andersson树是红黑树的一种更简单的替代方案,其中只有正确的链接可以是红色的。这大大简化了维护,同时保持了与红黑树相同的性能。原论文给出了一个很好的简短的插入和删除实现。

Gerth Stølting Brodal和Chris Okasaki的自助倾斜二项式堆:

尽管它们的名字很长,但即使在函数设置中,它们也提供了渐近最优的堆操作。

O(1)尺寸,接头,插入件,最小值O(log n)删除最小值

注意,union需要O(1)而不是O(log n)时间,这与数据结构教科书中通常包含的更为知名的堆(如左派堆)不同。与斐波那契堆不同,这些渐近线是最坏的情况,而不是摊销,即使持续使用!

Haskell中有多种实现。

在Brodal提出了一个具有相同渐近线的命令堆之后,它们由Brodal和Okasaki共同导出。

使用2个堆栈实现的队列非常节省空间(与使用至少有1个额外指针/引用开销的链接列表不同)。

如何使用两个堆栈实现队列?

当排队人数很大时,这对我来说效果很好。如果我在一个指针上节省了8个字节,这意味着拥有百万条目的队列节省了大约8MB的RAM。