周围有一些数据结构非常有用,但大多数程序员都不知道。他们是哪一个?

每个人都知道链表、二叉树和散列,但比如Skip列表和Bloom过滤器。我想知道更多不太常见但值得了解的数据结构,因为它们依赖于伟大的想法,丰富了程序员的工具箱。

PS:我还对舞蹈链接等技术感兴趣,这些技术巧妙地利用了通用数据结构的财产。

编辑:请尝试包含更详细描述数据结构的页面链接。此外,试着补充几句关于数据结构为什么很酷的话(正如乔纳斯·Kölker已经指出的那样)。此外,尝试为每个答案提供一个数据结构。这将允许更好的数据结构仅根据其投票结果浮到顶部。


当前回答

哈希表的一个有趣的变体叫做布谷鸟哈希。为了处理哈希冲突,它使用多个哈希函数而不是1。通过从主哈希指定的位置删除旧对象,并将其移动到备用哈希函数指定的位置,可以解决冲突。Cuckoo Hashing允许更有效地使用内存空间,因为您只需要3个哈希函数就可以将负载因子提高91%,而且访问时间也很长。

其他回答

持久数据结构

有一种巧妙的数据结构,它使用数组来保存元素的数据,但数组在链接列表/数组中链接在一起。

这确实具有这样的优点,即对元素的迭代非常快(比纯链接列表方法更快),并且在内存和/或(去)分配中移动带有元素的数组的成本最低。(正因为如此,此数据结构对于模拟工作非常有用)。

我从这里知道:

http://software.intel.com/en-us/blogs/2010/03/26/linked-list-verses-array/

“……并且一个额外的数组被分配并链接到粒子数组的单元格列表中。这在某些方面类似于TBB实现其并发容器的方式。”(这是关于链接列表与数组的性能)

空间索引,特别是R-树和KD树,有效地存储空间数据。它们适用于地理地图坐标数据和VLSI位置和路线算法,有时也适用于最近邻搜索。

位阵列紧凑地存储单个位,并允许快速位操作。

我认为当您需要将一堆项目划分为不同的集合和查询成员时,不联合集合非常适合。联合和查找操作的良好实施导致摊余成本实际上是恒定的(如果我正确回忆起我的数据结构类,则与阿克曼南函数相反)。

循环或环形缓冲区-用于流式传输等。