全域哈希是什么意思

全域哈希是一种哈希函数的设计技术,它能够减小冲突的概率,从而提高哈希表的性能。与传统的哈希函数不同的是,全域哈希会随机地选择一个哈希函数,而不是固定选取一个哈希函数,这样可以在多个哈希函数间随机选择,从而达到减小冲突的目的。

一、全域哈希的概念

全域哈希是一种哈希函数的设计技术,它能够减小冲突的概率,从而提高哈希表的性能。与传统的哈希函数不同的是,全域哈希会随机地选择一个哈希函数,而不是固定选取一个哈希函数,这样可以在多个哈希函数间随机选择,从而达到减小冲突的目的。

设U为键的全域,H是哈希函数的有限集,H中的哈希函数将U映射到哈希表的槽0, 1, ⋯, m-1里。如果满足:

x,yUx​=y,∣hH:h(x)=h(y)∣=mH∣​

我们称H是全域的。等式左边表示把x和y映射到同一个槽的哈希函数的数目。这样的话,如果从H中随机选择一个哈希函数,那么x和y发生碰撞的概率就是1/m。怎么得到的,就是在所有的函数集H中选出一个满足条件(x和y发生碰撞)的h,满足条件的h有|H|/m个,因此用满足条件的数目除以总数目,|H|/m除以|H|得到1/m。

换句话说,就是对于任意的不相等key的x和y, 从哈希函数集中选择一个哈希函数,这两个key,发生冲突的概率是1/m。

二、全域哈希的构造

  1. 从全域哈希函数族(Universal Hash Function Family)中随机选择一个哈希函数。
  2. 全域哈希函数族是一个哈希函数的集合,其中每个哈希函数都可以将输入空间映射到输出空间。在全域哈希函数族中,每个哈希函数的输出值和输入值之间的随机性都是相互独立的,这样就能避免哈希冲突的发生。
  3. 全域哈希函数族的数量(即哈希函数的个数)应该足够大,防止哈希冲突。

三、完全哈希

全域哈希是用随机函数的思想,但是有很小的概率冲突,解决方案:完全哈希。

当键值是static(即固定不变)的时候,我们可以涉及方案使得最差情况下的查询性能也很出色,这就是完全哈希。完全哈希可以在最坏情况下以O(1)复杂度查找,性能非常出色的。完美哈希的思想就是采用两级的框架,每一级上都用全域哈希。

将第一级全域哈希冲突的元素散列到二级哈希(槽数扩大为冲突元素数量的平方)上,使其不再冲突(冲突的几率<1/2),若继续冲突,则尝试其他哈希函数,很容易就得到不冲突的哈希函数。(数据为静态)

同时,在一个完全哈希方案中,存储所有二次哈希表所需的存储总量期望值小于2n(空间复杂度期望为线性),所以只需从全域哈希函数类中随机选择哈希函数,尝试几次就可以快速找到一个所需存储量较为合理的函数。

四、什么是哈希

Hash,一般翻译做散列、杂凑,或音译为哈希,是把任意长度的输入(又叫做预映射pre-image)通过散列算法变换成固定长度的输出,该输出就是散列值。这种转换是一种压缩映射,也就是,散列值的空间通常远小于输入的空间,不同的输入可能会散列成相同的输出,所以不可能从散列值来确定唯一的输入值。简单的说就是一种将任意长度的消息压缩到某一固定长度的消息摘要的函数。

常用HASH函数:

  1. 直接寻址法:取关键字或关键字的某个线性函数值为散列地址。即H(key)=key或H(key) = a·key + b,其中a和b为常数(这种散列函数叫做自身函数)
  2. 数字分析法:分析一组数据,比如一组员工的出生年月日,这时我们发现出生年月日的前几位数字大体相同,这样的话,出现冲突的几率就会很大,但是我们发现年月日的后几位表示月份和具体日期的数字差别很大,如果用后面的数字来构成散列地址,则冲突的几率会明显降低。因此数字分析法就是找出数字的规律,尽可能利用这些数据来构造冲突几率较低的散列地址。
  3. 平方取中法:取关键字平方后的中间几位作为散列地址。
  4. 折叠法:将关键字分割成位数相同的几部分,最后一部分位数可以不同,然后取这几部分的叠加和(去除进位)作为散列地址。
  5. 随机数法:选择一随机函数,取关键字作为随机函数的种子生成随机值作为散列地址,通常用于关键字长度不同的场合。
  6. 除留余数法:取关键字被某个不大于散列表表长m的数p除后所得的余数为散列地址。即 H(key) = key MOD p,p<=m。不仅可以对关键字直接取模,也可在折叠、平方取中等运算之后取模。对p的选择很重要,一般取素数或m,若p选的不好,容易产生碰撞。

延伸阅读

全域哈希解决的问题

选择哈希函数时,要随机选择,与输入的哈希运算的键保存独立,程序员本身也不能确定在实际运行时会用到哪一个哈希函数,无法预测随机数的输出,使用全域哈希可以解决该问题。

文章标题:全域哈希是什么意思,发布者:Z, ZLW,转载请注明出处:https://worktile.com/kb/p/49182

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
Z, ZLWZ, ZLW认证作者
上一篇 2023年4月13日
下一篇 2023年4月13日

相关推荐

  • 少儿编程什么软件

    少儿编程软件主要包括Scratch、Code.org、Swift Playgrounds、Tynker和Alice等。 比如,Scratch 是麻省理工学院开发针对8至16岁儿童的编程语言,由于其直观的拖拽编程方式和丰富的社区资源,它被广泛用于儿童编程教育。这款软件让孩子们可以创建动画、游戏和互动故…

    2024年5月2日
    1700
  • 零基础学编程学什么软件

    零基础学习编程应该着重学习的软件包括1、集成开发环境(IDE),2、文本编辑器,3、版本控制系统。其中,集成开发环境(IDE) 是非常基础且重要的软件工具,它为编程初学者提供了一个便捷的编码平台。IDE整合了编写、调试和编译代码的功能,降低了设置和管理多个工具的复杂性。例如,对于学习Java语言的初…

    2024年4月27日
    4100
  • 团队如何管理项目时间安排

    项目时间管理对于确保项目按计划完成至关重要,有效管理项目时间安排可以避免延误、节省成本、提高团队效率。要有效地管理项目时间安排,首要步骤是创建一个详细的项目计划,其中包括识别活动、分配资源、确定时间框架和监控进度。其中,创建和遵循项目进度计划是至关重要的一步,它涉及到为每个任务分配开始和结束日期,并…

    2024年4月10日
    10100
  • eclipse和myeclipse有哪些区别

    eclipse和myeclipse的区别有:1、性质不同;2、收费标准不同;3、支持不同。Myeclipse是在eclipse 基础上加上自己的插件开发而成的基于Java的可扩展开发平台。Eclipse 是一个开放源代码的、基于Java的可扩展开发平台,它只是一个框架和一组服务,用于通过插件组件构建…

    2023年2月12日
    2.4K00
  • 现阶段的编程语言都有什么缺陷

    Python的劣势是速度较慢,且有一些特定情况下才会出现(无法重现)的 bug;C/C++C/C++的劣势是学习难度大,且拥有大量极为复杂的功能交互方式,容易造成资源浪费;Java的劣势是占用大量内存,并且启动时间较长;C#的劣势是跨平台能力太差,且在国内就业环境不太好。 Python 优势:简单易…

    2023年2月22日
    40500
  • 做什么需要编程

    ABSTRACT Programming is essential for numerous tasks, including 1、Development of software applications, 2、Creation of websites, 3、Data analysis, 4、Aut…

    2024年5月2日
    1000
  • 什么编程app好

    编程App的优选包括1、交互式学习环境、2、丰富的编程语言支持、3、个性化学习路径、4、实时的代码执行和反馈机制、5、可访问性和用户体验。 其中,交互式学习环境是至关重要的优选标准。交互式学习环境可以提升用户的学习效率,创建真实编程场景,使用户在学习过程中更加投入。此类环境通常包含代码编辑器、编译器…

    2024年5月2日
    2000
  • 编程gc是什么

    编程中的GC是指垃圾收集(Garbage Collection)机制,它是一种自动管理程序内存的过程。1、自动识别无用数据是其核心功能之一,旨在释放不再使用的内存空间,以避免内存泄漏和程序崩溃。详细来说,自动识别无用数据意味着GC机制能够追踪每一块分配的内存,判断其是否还有用。如果一块内存不再被任何…

    2024年5月2日
    1100
  • 编程SEO是什么意思

    编程SEO意味着利用编码和程序化技术来优化网站,从而提高其在搜索引擎中的排名。1、自动化SEO任务是其核心应用之一。通过脚本或程序自动执行重复性任务,如网站内容的自动更新、关键词的优化、以及监控网站性能,可以极大地提高工作效率并确保网站的SEO策略得以持续和有序地执行。 一、SEO与编程的融合 编程…

    2024年4月27日
    3900
  • hadoop用什么编程

    Hadoop主要使用Java语言进行编程。Java因其跨平台性、面向对象特性以及丰富的API而被选作Hadoop的主要编程语言,这让Hadoop能够在各种操作系统上无缝运行,同时也简化了大规模数据处理任务的编程工作。在分布式数据处理框架中,Java语言的这些优点尤为重要,它能够保证性能的同时,也确保…

    2024年5月2日
    1300

发表回复

登录后才能评论
注册PingCode 在线客服
站长微信
站长微信
电话联系

400-800-1024

工作日9:30-21:00在线

分享本页
返回顶部