周围有一些数据结构非常有用,但大多数程序员都不知道。他们是哪一个?

每个人都知道链表、二叉树和散列,但比如Skip列表和Bloom过滤器。我想知道更多不太常见但值得了解的数据结构,因为它们依赖于伟大的想法,丰富了程序员的工具箱。

PS:我还对舞蹈链接等技术感兴趣,这些技术巧妙地利用了通用数据结构的财产。

编辑:请尝试包含更详细描述数据结构的页面链接。此外,试着补充几句关于数据结构为什么很酷的话(正如乔纳斯·Kölker已经指出的那样)。此外,尝试为每个答案提供一个数据结构。这将允许更好的数据结构仅根据其投票结果浮到顶部。


当前回答

二进制决策图是我最喜欢的数据结构之一,或者实际上是降序二进制决策图(ROBDD)。

例如,此类结构可用于:

表示项目集合并对这些集合执行非常快速的逻辑运算。任何布尔表达式,旨在查找表达式的所有解

注意,许多问题可以用布尔表达式表示。例如,suduku的解可以表示为布尔表达式。为该布尔表达式构建BDD将立即生成解决方案。

其他回答

我喜欢字符串处理的后缀树和数组,平衡列表的跳过列表,自动平衡树的显示树

哈希表的一个有趣的变体叫做布谷鸟哈希。为了处理哈希冲突,它使用多个哈希函数而不是1。通过从主哈希指定的位置删除旧对象,并将其移动到备用哈希函数指定的位置,可以解决冲突。Cuckoo Hashing允许更有效地使用内存空间,因为您只需要3个哈希函数就可以将负载因子提高91%,而且访问时间也很长。

Burrows–Wheeler变换(块排序压缩)

它是压缩的基本算法。假设您想压缩文本文件中的行。你会说,如果你对行进行排序,你就失去了信息。但BWT是这样工作的——它通过对输入进行排序,保持整数索引以恢复原始顺序,从而大大降低了熵。

Hinze和Paterson的2-3手指树是一种功能强大的数据结构瑞士军刀,具有很好的渐近线,适用于各种操作。虽然复杂,但它们比之前的Kaplan和Tarjan通过递归减速实现的持久列表的命令式结构简单得多。

它们作为一个可链接的deque,O(1)访问任意一端,O(log-min(n,m))追加,并提供O(log-main(n),length-n))索引,直接访问序列的任何部分上的单形前缀和。

实现存在于Haskell、Coq、F#、Scala、Java、C、Clojure、C#和其他语言中。

您可以使用它们来实现优先级搜索队列、区间映射、具有快速头部访问的绳索、映射、集合、可链接序列或几乎任何结构,您可以将其表述为在快速可链接/可索引序列上收集单形结果。

我还有一些幻灯片描述了它们的派生和使用。

我有时使用反转列表来存储范围,它们通常用于在正则表达式中存储字符类。例如,请参见http://www.ibm.com/developerworks/linux/library/l-cpinv.html

另一个很好的用例是加权随机决策。假设你有一个符号和相关概率的列表,你想根据这些概率随机选择它们

   a => 0.1
   b => 0.5
   c => 0.4

然后,你对所有概率进行一次连续求和:

  (0.1, 0.6, 1.0)

这是你的反转列表。生成一个介于0和1之间的随机数,并查找列表中下一个较高条目的索引。你可以用二进制搜索来实现,因为它是排序的。一旦获得了索引,就可以在原始列表中查找符号。

如果有n个符号,则每个随机选择的符号都有O(n)个准备时间,然后是O(log(n))个访问时间,与权重分布无关。

反转列表的一种变体使用负数来指示范围的端点,这使得计算某一点上有多少范围重叠变得容易。看见http://www.perlmonks.org/index.pl?node_id=841368例如。