周围有一些数据结构非常有用,但大多数程序员都不知道。他们是哪一个?

每个人都知道链表、二叉树和散列,但比如Skip列表和Bloom过滤器。我想知道更多不太常见但值得了解的数据结构,因为它们依赖于伟大的想法,丰富了程序员的工具箱。

PS:我还对舞蹈链接等技术感兴趣,这些技术巧妙地利用了通用数据结构的财产。

编辑:请尝试包含更详细描述数据结构的页面链接。此外,试着补充几句关于数据结构为什么很酷的话(正如乔纳斯·Kölker已经指出的那样)。此外,尝试为每个答案提供一个数据结构。这将允许更好的数据结构仅根据其投票结果浮到顶部。


当前回答

展开的链接列表是链接列表的变体,它在每个节点中存储多个元素。它可以显著提高缓存性能,同时减少与存储列表元数据(如引用)相关的内存开销。它与B树有关。

record node {
    node next       // reference to next node in list
    int numElements // number of elements in this node, up to maxElements
    array elements  // an array of numElements elements, with space allocated for maxElements elements
}

其他回答

根据Bloom Filter提到的,可删除Bloom Filter(DlBF)在某些方面优于基本计数变体。看见http://arxiv.org/abs/1005.0352

我不确定这个数据结构是否有名字,但是提议的包含在Boost中的tokenmap数据结构有点有趣。这是一个动态调整大小的映射,其中查找不仅是O(1),而且是简单的数组访问。我写了关于这个数据结构的大部分背景材料,其中描述了它如何工作的基本原理。

操作系统使用类似于tokenmap的东西来将文件或资源句柄映射到表示文件或资源的数据结构。

Fast Compact尝试:

Judy数组:用于位、整数和字符串的非常快速且内存高效的有序稀疏动态数组。Judy数组比任何二进制搜索树都更快、更节省内存。HAT-trie:一种基于缓存的字符串数据结构基于磁盘的字符串管理的B次尝试

成对堆是一种堆数据结构,具有相对简单的实现和出色的实际摊余性能。

DAWG是一种特殊的Trie,其中类似的子树被压缩为单亲。我扩展了修改后的DAWG,并提出了一个漂亮的数据结构ASSDAWG(Anagram Search Sorted DAWG)。这种工作方式是,每当将字符串插入DAWG时,首先对其进行桶排序,然后插入,叶节点保存一个额外的数字,指示如果我们从根到达该叶节点,哪些排列是有效的。这有两大优点:

由于我在插入之前对字符串进行排序,并且DAWG自然会折叠类似的子树,所以我得到了高级别的压缩(例如,“吃”、“吃”和“茶”都变成了一条路径a-e-t,在叶节点处有一个数字列表,指示a-e-t的哪些排列是有效的)。搜索给定字符串的变位现在是非常快速和简单的,因为从根到叶的路径使用排列数保存了叶节点处该路径的所有有效变位。