周围有一些数据结构非常有用,但大多数程序员都不知道。他们是哪一个?

每个人都知道链表、二叉树和散列,但比如Skip列表和Bloom过滤器。我想知道更多不太常见但值得了解的数据结构,因为它们依赖于伟大的想法,丰富了程序员的工具箱。

PS:我还对舞蹈链接等技术感兴趣,这些技术巧妙地利用了通用数据结构的财产。

编辑:请尝试包含更详细描述数据结构的页面链接。此外,试着补充几句关于数据结构为什么很酷的话(正如乔纳斯·Kölker已经指出的那样)。此外,尝试为每个答案提供一个数据结构。这将允许更好的数据结构仅根据其投票结果浮到顶部。


当前回答

Zippers——数据结构的衍生物,可以修改结构,使其具有“光标”的自然概念——当前位置。这些非常有用,因为它们保证了标记不会超出范围——例如在xmonad窗口管理器中使用,以跟踪哪个窗口已聚焦。

令人惊讶的是,您可以通过将微积分技术应用于原始数据结构的类型来派生它们!

其他回答

PATRICIA-检索字母数字编码信息的实用算法,D.R.Morrison(1968)。

PATRICIA树与Trie相关。Tries的问题是,当密钥集稀疏时,即当实际密钥形成潜在密钥集的一个子集时,Trie中的许多(大多数)内部节点只有一个后代,这是非常常见的情况。这导致Trie具有较高的空间复杂性。

http://www.csse.monash.edu.au/~合金/瓷砖AlgdS/树/PATRICIA/

铲斗大队

它们在Apache中被广泛使用。基本上,它们是一个在环中围绕自身循环的链接列表。我不确定它们是否在Apache和Apache模块之外使用,但它们适合作为一种很酷但鲜为人知的数据结构。桶是一些任意数据的容器,桶大队是桶的集合。其思想是,您希望能够在结构中的任何点修改和插入数据。

假设您有一个bucket旅,其中包含一个html文档,每个bucket包含一个字符。您希望将所有<和>符号转换为&lt;并且&gt;实体。当您遇到<或>符号时,bucket旅允许您在旅中插入一些额外的bucket,以适应实体所需的额外字符。因为铲斗大队在一个环中,您可以向后或向前插入。这比使用简单的缓冲区要容易得多(在C语言中)。

关于铲斗大队的一些参考信息如下:

Apache Bucket旅参考

Buckets和Brigades简介

BK树或Burkhard Keller树是一种基于树的数据结构,可用于快速查找字符串的近似匹配项。

我认为保罗·费拉吉纳和乔凡尼·曼奇尼的FM指数真的很酷。尤其是在生物信息学方面。它本质上是一个压缩的全文索引,利用了后缀数组和参考文本的burrows-wheeler变换的组合。可以在不解压缩整个索引的情况下搜索索引。

我不确定这个数据结构是否有名字,但是提议的包含在Boost中的tokenmap数据结构有点有趣。这是一个动态调整大小的映射,其中查找不仅是O(1),而且是简单的数组访问。我写了关于这个数据结构的大部分背景材料,其中描述了它如何工作的基本原理。

操作系统使用类似于tokenmap的东西来将文件或资源句柄映射到表示文件或资源的数据结构。