周围有一些数据结构非常有用,但大多数程序员都不知道。他们是哪一个?

每个人都知道链表、二叉树和散列,但比如Skip列表和Bloom过滤器。我想知道更多不太常见但值得了解的数据结构,因为它们依赖于伟大的想法,丰富了程序员的工具箱。

PS:我还对舞蹈链接等技术感兴趣,这些技术巧妙地利用了通用数据结构的财产。

编辑:请尝试包含更详细描述数据结构的页面链接。此外,试着补充几句关于数据结构为什么很酷的话(正如乔纳斯·Kölker已经指出的那样)。此外,尝试为每个答案提供一个数据结构。这将允许更好的数据结构仅根据其投票结果浮到顶部。


当前回答

根据Bloom Filter提到的,可删除Bloom Filter(DlBF)在某些方面优于基本计数变体。看见http://arxiv.org/abs/1005.0352

其他回答

芬威克树。这是一种数据结构,用于计算向量中两个给定的子索引i和j之间的所有元素的总和。简单的解决方案是,从开始时就预先计算总和,不允许更新项目(必须做O(n)工作才能跟上)。

Fenwick Trees允许您在O(logn)中更新和查询,它的工作方式非常简单。芬威克的原始论文对这一点做了很好的解释,可以在这里免费获得:

http://www.cs.ubc.ca/local/reading/proceedings/spe91-95/spe/vol24/issue3/spe884.pdf

它的父亲RQM树也很酷:它允许您保存关于向量的两个索引之间的最小元素的信息,它还可以在O(logn)更新和查询中工作。我喜欢先教RQM,然后教芬威克树。

二进制决策图(我最喜欢的数据结构,擅长表示布尔方程并解决它们。适用于很多事情)堆(一个树,其中节点的父节点总是与节点的子节点保持某种关系,例如,节点的父级总是大于它的每个子节点(最大堆))优先级队列(实际上只有最小堆和最大堆,有助于维护大量元素的顺序,例如,应该首先删除具有最高值的项目)哈希表(具有各种查找策略和桶溢出处理)平衡的二进制搜索树(每种都有自己的优点)RB树(当以有序方式插入、查找、删除和迭代时,总体良好)Avl树(查找速度比RB快,但其他方面与RB非常相似)Splay树(当最近使用的节点可能被重用时,查找速度更快)融合树(利用快速乘法获得更好的查找时间)B+树(用于数据库和文件系统中的索引,当从索引读取/写入索引的延迟很长时非常有效)。空间索引(非常适合查询点/圆/矩形/线/立方体是否彼此接近或包含在其中)BSP树四叉树八叉树范围树许多相似但略有不同的树木,不同的尺寸区间树(很好地找到重叠区间,线性)图邻接列表(基本上是边的列表)邻接矩阵(表示图的有向边的表,每边一个位。对于图遍历非常快速)

这些是我能想到的。维基百科上还有更多关于数据结构的内容

B*树

这是一种以更昂贵的插入为代价的高效搜索的B树。

Van Emde Boas树

我想知道它们为什么很酷会很有用。一般来说,“为什么”这个问题是最重要的;)

我的答案是,他们给你O(log-logn)字典,其中包含{1..n}个键,而与使用的键的数量无关。就像重复减半得到O(log n)一样,重复平方得到O(log-log n),这就是vEB树中发生的情况。

我认为保罗·费拉吉纳和乔凡尼·曼奇尼的FM指数真的很酷。尤其是在生物信息学方面。它本质上是一个压缩的全文索引,利用了后缀数组和参考文本的burrows-wheeler变换的组合。可以在不解压缩整个索引的情况下搜索索引。