• Set接口的实现类---HashSet


    HashSet类

    HashSet类直接实现了Set接口, 其底层其实是包装了一个HashMap去实现的,以需要存储的数据作为map的key值,以常量PRESENT作为value值

    private transient HashMap map;

    private static final Object PRESENT=new Object();

    HashSet采用HashCode算法来存取集合中的元素,因此具有比较好的读取和查找性能

    1. Set set=new HashSet<>();
    2. Person p1=new Person();
    3. Person p2=new Person();
    4. set.add(p1);
    5. set.add(p2);
    6. System.out.println(set.size());

    这里显示值为2,因为 Person类中的hashCode方法和equals方法都来自于Object类

    1. public class Test2 {
    2. public static void main(String[] args) {
    3. A2 a1=new A2();
    4. A2 a2=new A2();
    5. System.out.println(a1==a2); //false
    6. System.out.println(a1.equals(a2)); //false ? 这是因为A2类的equals是从java.lang.Object类中继承得到的,具体实现还是==
    7. }
    8. }
    9. class A2{
    10. private Long id;
    11. private String name;
    12. public Long getId() {
    13. return id;
    14. }
    15. public void setId(Long id) {
    16. this.id = id;
    17. }
    18. public String getName() {
    19. return name;
    20. }
    21. public void setName(String name) {
    22. this.name = name;
    23. }
    24. }
    1. import java.util.HashSet;
    2. import java.util.Objects;
    3. import java.util.Set;
    4. public class Test20 {
    5. public static void main(String[] args) {
    6. A20 a1=new A20();
    7. A20 a2=new A20();
    8. System.out.println(a1==a2); //false
    9. System.out.println(a1.equals(a2)); //true
    10. Set set=new HashSet<>();
    11. set.add(a1);
    12. set.add(a2);
    13. System.out.println(set.size()); //2? 这是因为对象比较时,首先调用hashCode方法,如果两个对象
    14. //的hashCode值相等才会继续调用equals比较,否则直接返回false
    15. }
    16. }
    17. class A20{
    18. private Long id;
    19. private String name;
    20. public Long getId() {
    21. return id;
    22. }
    23. public void setId(Long id) {
    24. this.id = id;
    25. }
    26. public String getName() {
    27. return name;
    28. }
    29. public void setName(String name) {
    30. this.name = name;
    31. }
    32. //添加则返回1
    33. // @Override
    34. // public int hashCode() {
    35. // return Objects.hash(id, name);
    36. // }
    37. @Override
    38. public boolean equals(Object obj) {
    39. if (this == obj)
    40. return true;
    41. if (obj == null)
    42. return false;
    43. if (getClass() != obj.getClass())
    44. return false;
    45. A20 other = (A20) obj;
    46. return Objects.equals(id, other.id) && Objects.equals(name, other.name);
    47. }
    48. }
    1. 在Person类中添加方法
    2. public boolean equals(Object obj){
    3. if(obj!=null && obj instanceof Person){
    4. Person p=(Person)obj;
    5. //具体的比较内容取决于业务规则,这里不进行判空了(偷懒)
    6. return this.id==p.id && this.name.equals(p.name);
    7. }
    8. return false;
    9. }

    问题在于hashcode值 
    public int hashCode(){
        return this.id.hashCode();
    }

    原因在于:向HashSet中添加元素时首先执行的是对象的hashcode值比较,如果两个
    对象的hashcode值相等时才会继续调用equals方法;如果两个对象的hashcode值不
    相等则不会调用equals方法

    向set中添加元素到底比较是采用==还是equals?
    Set set=new HashSet<>();
    String s1="abc";
    String s2=new String("abc");
    System.out.println(s1==s2);
    set.add(s1);
    set.add(s2);
    System.out.println(set.size());  //返回为1

    HashSet实际上是通过使用HashMap的key实现的,所有key对应的value都是一个常量

    散列算法

    散列法Hashing是一种将字符组成的字符串转换为固定长度(一般是更短长度)的数值或索引值的方法,称为散列法,也叫哈希法。

    由于通过更短的哈希值比用原始值进行数据库搜索更快,这种方法一般用来在数据库中,建立索引并进行搜索,同时还用在各种解密算法中

    当然在存储时需要解决哈希碰撞问题

    通常处理碰撞的方法有开放寻址Open Addressing法和链地址法

    String类型中的hashCode方法的实现:
      public int hashCode() {
            int h = hash;
            if (h == 0 && value.length > 0) {
                hash = h = isLatin1() ? StringLatin1.hashCode(value)
                                      : StringUTF16.hashCode(value);
            }
            return h;
        }

    由于自定义类都会直接或者间接的继承于java.lang.Object,所以所有的类中都有hashCode
    方法
            public native int hashCode();

    HashSet的特征

    1、无序:不仅不能保证元素插入的顺序(如果需要顺序则可以使用LinkedHashSet) ,而且在元素在以后的顺序中也可能变化(这是由HashSet按HashCode存储对象(元素)决定的,对象变化则可能导致HashCode变化)

            如果需要访问的顺序和插入的顺序一致,可以使用HashSet的子类LinkedHashSet

    2、不允许重复 [equals和hashcode]
    3、HashSet是线程非安全的,方法上没有同步约束

    如何判断两个对象相等 

    实现Set接口的HashSet,依靠HashMap来实现的。

    我们应该为要存放到散列表的各个对象定义hashCode()和equals()

    HashSet的equals和hashCode

    那么HashSet如何判断元素重复呢?
            HashSet需要同时通过equals和HashCode来判断两个元素是否相等,具体规则是,如果两个元素通过equals为true,并且两个元素的hashCode相等,则这两个元素相等(即重复)。所以如果要重写保存在HashSet中的对象的equals方法,也要重写hashCode方法,重写前后hashCode返回的结果相等(即保证保存在同一个位置)。所有参与计算 hashCode() 返回值的关键属性,都应该用于作为 equals() 比较的标准。
        
        结论:要求当两个同类型对象equals为true时,必须hashCode值一致。事实上equals方法和hashCode方法没有任何必然联系

  • 相关阅读:
    python与PySpark
    FreeFileSync开机实时自动同步文件
    无涯教程-Android Mock Test函数
    集合java
    不同的二叉搜索树【动态规划】
    国产+开源:可视化流程引擎助力企业建立流程管理体系
    less & sass 函数定义和使用, 样式书写事半功倍
    Softing smartLink产品系列新版本为工厂资产管理提供了扩展功能
    Linux 系统之 CentOS 和 Ubuntu 的区别
    redis报错 Error getaddrinfo ENOTFOUND
  • 原文地址:https://blog.csdn.net/tiger_root/article/details/126859151