• 说一下HashMap的实现原理?


    目录

    • 什么是哈希表

    • HashMap实现原理

    • 为何HashMap的数组长度一定是2的次幂?

    • 重写equals方法需同时重写hashCode方法

    • 总结

    一、什么是哈希表

    在讨论哈希表之前,我们先大概了解下其他数据结构在新增,查找等基础操作执行性能

    数组:采用一段连续的存储单元来存储数据。对于指定下标的查找,时间复杂度为O(1);通过给定值进行查找,需要遍历数组,逐一比对给定关键字和数组元素,时间复杂度为O(n),当然,对于有序数组,则可采用二分查找,插值查找,斐波那契查找等方式,可将查找复杂度提高为O(logn);对于一般的插入删除操作,涉及到数组元素的移动,其平均复杂度也为O(n)

    线性链表:对于链表的新增,删除等操作(在找到指定操作位置后),仅需处理结点间的引用即可,时间复杂度为O(1),而查找操作需要遍历链表逐一进行比对,复杂度为O(n)

    二叉树:对一棵相对平衡的有序二叉树,对其进行插入,查找,删除等操作,平均复杂度均为O(logn)。

    哈希表:相比上述几种数据结构,在哈希表中进行添加,删除,查找等操作,性能十分之高,不考虑哈希冲突的情况下,仅需一次定位即可完成,时间复杂度为O(1),接下来我们就来看看哈希表是如何实现达到惊艳的常数阶O(1)的。

    我们知道,数据结构的物理存储结构只有两种:顺序存储结构和链式存储结构(像栈,队列,树,图等是从逻辑结构去抽象的,映射到内存中,也这两种物理组织形式),而在上面我们提到过,在数组中根据下标查找某个元素,一次定位就可以达到,哈希表利用了这种特性,哈希表的主干就是数组

    比如我们要新增或查找某个元素,我们通过把当前元素的关键字 通过某个函数映射到数组中的某个位置,通过数组下标一次定位就可完成操作。

    存储位置 = f(关键字)

    其中,这个函数f一般称为哈希函数,这个函数的设计好坏会直接影响到哈希表的优劣。举个例子,比如我们要在哈希表中执行插入操作:

    查找操作同理,先通过哈希函数计算出实际存储地址,然后从数组中对应地址取出即可。

    哈希冲突

    然而万事无完美,如果两个不同的元素,通过哈希函数得出的实际存储地址相同怎么办?也就是说,当我们对某个元素进行哈希运算,得到一个存储地址,然后要进行插入的时候,发现已经被其他元素占用了,其实这就是所谓的哈希冲突,也叫哈希碰撞。

    前面我们提到过,哈希函数的设计至关重要,好的哈希函数会尽可能地保证 计算简单和散列地址分布均匀,但是,我们需要清楚的是,数组是一块连续的固定长度的内存空间,再好的哈希函数也不能保证得到的存储地址绝对不发生冲突。

    那么哈希冲突如何解决呢?哈希冲突的解决方案有多种:开放定址法(发生冲突,继续寻找下一块未被占用的存储地址),再散列函数法,链地址法,而HashMap即是采用了链地址法,也就是数组+链表的方式,

    二、HashMap实现原理

    HashMap的主干是一个Entry数组。Entry是HashMap的基本组成单元,每一个Entry包含一个key-value键值对。

    1. //HashMap的主干数组,可以看到就是一个Entry数组,初始值为空数组{},主干数组的长度一定是2的次幂,至于为什么这么做,后面会有详细分析。
    2. transient Entry<K,V>[] table = (Entry<K,V>[]) EMPTY_TABLE;

    Entry是HashMap中的一个静态内部类。代码如下

    1. static class Entry<K,V> implements Map.Entry<K,V> {
    2.         final K key;
    3.         V value;
    4.         Entry<K,V> next;//存储指向下一个Entry的引用,单链表结构
    5.         int hash;//key的hashcode值进行hash运算后得到的值,存储在Entry,避免重复计算
    6.         /**
    7.          * Creates new entry.
    8.          */
    9.         Entry(int h, K k, V v, Entry<K,V> n) {
    10.             value = v;
    11.             next = n;
    12.             key = k;
    13.             hash = h;
    14.         }

    所以,HashMap的整体结构如下

  • 相关阅读:
    C语言 | Leetcode C语言题解之第141题环形链表
    登陆认证&权限控制(1)——从session到token认证的变迁 & session的问题分析 + CSRF攻击的认识
    XAPI项目架构:应对第三方签名认证的设计与调整
    复盘:图像有哪些基本属性?关于图像的知识你知道哪些?图像的参数有哪些
    【C语言】初识指针(二)
    HTML——css与js案例练习
    大数据存储与处理
    (原创)【MAUI】在窗口(页面)关闭后获取其返回值
    BD Rhapsody单细胞分析系统
    百度地图实现热力图的添加、移除
  • 原文地址:https://blog.csdn.net/m0_72885838/article/details/126746274