HashMap 为什么线程不安全?

HashMap 为什么线程安全的? 阅读详情

我们都知道HashMap是线程不安全的,在多线程环境中不建议使用,但是其线程不安全主要体现在什么地方呢,本文将对该问题进行解密。

在jdk1.8中对HashMap做了很多优化,这里先分析在jdk1.7中的问题,相信大家都知道在jdk1.7多线程环境下HashMap容易出现死循环,这里我们先用代码来模拟出现死循环的情况:

public class HashMapTest {

    public static void main(String[] args) {
        HashMapThread thread0 = new HashMapThread();
        HashMapThread thread1 = new HashMapThread();
        HashMapThread thread2 = new HashMapThread();
        HashMapThread thread3 = new HashMapThread();
        HashMapThread thread4 = new HashMapThread();
        thread0.start();
        thread1.start();
        thread2.start();
        thread3.start();
        thread4.start();
    }
}

class HashMapThread extends Thread {
    private static AtomicInteger ai = new AtomicInteger();
    private static Map<Integer, Integer> map = new HashMap<>();

    @Override
    public void run() {
        while (ai.get() < 1000000) {
            map.put(ai.get(), ai.get());
            ai.incrementAndGet();
        }
    }
}

 

上述代码比较简单,就是开多个线程不断进行put操作,并且HashMap与AtomicInteger都是全局共享的。

 

在多运行几次该代码后,出现如下死循环情形:

 

其中有几次还会出现数组越界的情况:

 

这里我们着重分析为什么会出现死循环的情况,通过jps和jstack命名查看死循环情况,结果如下:

 

从堆栈信息中可以看到出现死循环的位置,通过该信息可明确知道死循环发生在HashMap的扩容函数中,根源在transfer函数中,jdk1.7中HashMap的transfer函数如下:

 

void transfer(Entry[] newTable, boolean rehash) {
        int newCapacity = newTable.length;
        for (Entry<K,V> e : table) {
            while(null != e) {
                Entry<K,V> next = e.next;
                if (rehash) {
                    e.hash = null == e.key ? 0 : hash(e.key);
                }
                int i = indexFor(e.hash, newCapacity);
                e.next = newTable[i];
                newTable[i] = e;
                e = next;
            }
        }
}

 

总结下该函数的主要作用:

在对table进行扩容到newTable后,需要将原来数据转移到newTable中,注意10-12行代码,这里可以看出在转移元素的过程中,使用的是头插法,也就是链表的顺序会翻转,这里也是形成死循环的关键点。

下面进行详细分析。

1.1 扩容造成死循环分析过程

 

前提条件,这里假设:

 

  1. hash算法为简单的用key mod链表的大小。

  2. 最开始hash表size=2,key=3,7,5,则都在table[1]中。

  3. 然后进行resize,使size变成4。

 

未resize前的数据结构如下:

 

 

如果在单线程环境下,最后的结果如下:

 

这里的转移过程,不再进行详述,只要理解transfer函数在做什么,其转移过程以及如何对链表进行反转应该不难。

 

然后在多线程环境下,假设有两个线程A和B都在进行put操作。线程A在执行到transfer函数中第11行代码处挂起,因为该函数在这里分析的地位非常重要,因此再次贴出来。

关注微信号:bjmsb10,备注:java,可以获取我整理的 N 篇最新Java 技术教程,都是干货。

 

此时线程A中运行结果如下:

 

线程A挂起后,此时线程B正常执行,并完成resize操作,结果如下:

 

 

这里需要特别注意的点:由于线程B已经执行完毕,根据Java内存模型,现在newTable和table中的Entry都是主存中最新值:7.next=3,3.next=null。

此时切换到线程A上,在线程A挂起时内存中值如下:e=3,next=7,newTable[3]=null,代码执行过程如下:

 

newTable[3]=e ----> newTable[3]=3
e=next ----> e=7

 

此时结果如下:

 

继续循环:

 

e=7
next=e.next ----> next=3【从主存中取值】
e.next=newTable[3] ----> e.next=3【从主存中取值】
newTable[3]=e ----> newTable[3]=7
e=next ----> e=3

 

结果如下:

再次进行循环:

e=3
next=e.next ----> next=null
e.next=newTable[3] ----> e.next=7 即:3.next=7
newTable[3]=e ----> newTable[3]=3
e=next ----> e=null

 

注意此次循环:e.next=7,而在上次循环中7.next=3,出现环形链表,并且此时e=null循环结束。

 

结果如下:

 

 

在后续操作中只要涉及轮询HashMap的数据结构,就会在这里发生死循环,造成悲剧。

 

1.2 扩容造成数据丢失分析过程

 

遵照上述分析过程,初始时:

 

 

线程A和线程B进行put操作,同样线程A挂起:

 

 

此时线程A的运行结果如下:

 

 

此时线程B已获得CPU时间片,并完成resize操作:

 

 

同样注意由于线程B执行完成,newTable和table都为最新值:5.next=null。

 

此时切换到线程A,在线程A挂起时:e=7,next=5,newTable[3]=null。

 

执行newtable[i]=e,就将7放在了table[3]的位置,此时next=5。接着进行下一次循环:

 

e=5
next=e.next ----> next=null,从主存中取值
e.next=newTable[1] ----> e.next=5,从主存中取值
newTable[1]=e ----> newTable[1]=5
e=next ----> e=null

 

将5放置在table[1]位置,此时e=null循环结束,3元素丢失,并形成环形链表。并在后续操作HashMap时造成死循环。

 

 

在jdk1.8中对HashMap进行了优化,在发生hash碰撞,不再采用头插法方式,而是直接插入链表尾部,因此不会出现环形链表的情况,但是在多线程的情况下仍然不安全。

 

这里我们看jdk1.8中HashMap的put操作源码:

 

final V putVal(int hash, K key, V value, boolean onlyIfAbsent,
                   boolean evict) {
        Node<K,V>[] tab; Node<K,V> p; int n, i;
        if ((tab = table) == null || (n = tab.length) == 0)
            n = (tab = resize()).length;
        if ((p = tab[i = (n - 1) & hash]) == null) // 如果没有hash碰撞则直接插入元素
            tab[i] = newNode(hash, key, value, null);
        else {
            Node<K,V> e; K k;
            if (p.hash == hash &&
                ((k = p.key) == key || (key != null && key.equals(k))))
                e = p;
            else if (p instanceof TreeNode)
                e = ((TreeNode<K,V>)p).putTreeVal(this, tab, hash, key, value);
            else {
                for (int binCount = 0; ; ++binCount) {
                    if ((e = p.next) == null) {
                        p.next = newNode(hash, key, value, null);
                        if (binCount >= TREEIFY_THRESHOLD - 1) // -1 for 1st
                            treeifyBin(tab, hash);
                        break;
                    }
                    if (e.hash == hash &&
                        ((k = e.key) == key || (key != null && key.equals(k))))
                        break;
                    p = e;
                }
            }
            if (e != null) { // existing mapping for key
                V oldValue = e.value;
                if (!onlyIfAbsent || oldValue == null)
                    e.value = value;
                afterNodeAccess(e);
                return oldValue;
            }
        }
        ++modCount;
        if (++size > threshold)
            resize();
        afterNodeInsertion(evict);
        return null;
}

 

这是jdk1.8中HashMap中put操作的主函数, 注意第6行代码,如果没有hash碰撞则会直接插入元素。

 

如果线程A和线程B同时进行put操作,刚好这两条不同的数据hash值一样,并且该位置数据为null,所以这线程A、B都会进入第6行代码中。

 

假设一种情况,线程A进入后还未进行数据插入时挂起,而线程B正常执行,从而正常插入数据,然后线程A获取CPU时间片,此时线程A不用再进行hash判断了,问题出现:线程A会把线程B插入的数据给覆盖,发生线程不安全。

 

总结

 

首先HashMap是线程不安全的,其主要体现:

 

  1. 在jdk1.7中,在多线程环境下,扩容时会造成环形链或数据丢失。

  2. 在jdk1.8中,在多线程环境下,会发生数据覆盖的情况。

关于如何解决HashMap线程安全问题的介绍 HashMap为什么线程安全?如何解决HashMap线程安全问题? 立即下载

相关推荐

【并发】为什么HashMap线程安全的?

目录 1.什么是线程安全性(what) 2.如何分辨一个类是否线程安全?(HOW) 3.为什么hashmap安全 why 3.1 插入HashMap.put 3.1.1 HashMap 在扩容的时候 3.2 HashMap 在删除数据的时候 0.背景 经常会看到说HashMap线程安全的,ConcurrentHashMap线程安全的等等说法,禁有个疑问,什么是线程安全?什么样的类是线程安全的? 1.什么是线程安全性(what) 线程安全定义,最核心是正确性, 正确性:多个线程访问某个类,管怎么调度这些线程,其代码中需要额外的同步或协同(synchronized),这个类依然有正确

详解HashMap线程安全体现在哪里?

Java中,HashMap是一种常用的数据结构,它以键值对的形式存储和管理数据。然而,由于HashMap多线程环境下存在线程安全问题,因此在使用时需要格外小心。简单来说:在的时候,因为采用的是头插法,所以会可能会有循环链表产生,导致数据有问题,在 1.8 版本已修复,改为了尾插法;在任意版本的 hashMap 中,如果在,可能会有数据覆盖的情况发生,导致线程安全

2301_76607156的博客 2199

Java基础:为什么hashmap线程安全的?

HashMap线程安全的主要原因是它的内部结构和操作线程安全的。下面是一些导致 HashMap 线程安全的因素:非同步操作:HashMap 的操作线程同步的,也就是说,在多线程环境下同时对 HashMap 进行读写操作可能会导致数据一致的问题。非原子操作:HashMap 的操作是原子性的,例如 put() 方法涉及到了多个步骤,包括计算哈希值、查找或插入元素等。如果多个线程同时执行这些操作,就有可能导致数据一致的情况。

qq_53058639的博客 5119

国内AI大模型盘点

大模型通过训练海量数据来学习复杂的模式和特征,具有更强大的泛化能力,可以对未见过的数据做出准确的预测。原文链接:https://blog.csdn.net/2301_76168381/article/details/139677043。简介: 智谱华章自研的AI大模型,融合海量知识,可用于商业分析、决策辅助、客户服务等领域。简介: 阿里达摩院推出的大模型,拥有千亿参数,可用于智能问答、知识检索、文案创作等场景。简介: 科大讯飞推出的AI大模型,支持对话、写作、编程等功能,还能提供语音交互方式。

. 2135

java面试(9)HashMap为什么线程安全

其中第六行代码是判断是否出现hash碰撞,假设两个线程A、B都在进行put操作,并且hash函数计算出的插入下标是相同的,当线程A执行完第六行代码后由于时间片耗尽导致被挂起,而线程B得到时间片后在该下标处插入了元素,完成了正常的插入,然后线程A获得时间片,由于之前已经进行了hash碰撞的判断,所有此时会再进行判断,而是直接进行插入,这就导致了线程B插入的数据被线程A覆盖了,从而线程安全。上轮next=3,e=3,执行下一次循环可以发现,3.next=null,所以此轮循环将会是最后一轮循环。

babyZeng 1416

HashMap为什么线程安全

一、学习目标 1、HashMap线程安全原因原因: JDK1.7 中,由于多线程HashMap进行扩容,调用了HashMap#transfer(),具体原因:某个线程执行过程中,被挂起,其他线程已经完成数据迁移,等CPU资源释放后被挂起的线程重新执行之前的逻辑,数据已经被改变,造成死循环、数据丢失。 JDK1.8 中,由于多线程HashMap进行put操作,调用了HashMap#putVal(),具体原因:假设两个线程A、B都在进行put操作,并且hash函数计算出的插入下标是相同的,当线程A执行

Java技术 2万+

图解HashMap为什么线程安全

HashMap线程安全主要体现在下面两个方面: 1.在JDK1.7中,当并发执行扩容操作时会造成环形链和数据丢失的情况。 2.在JDK1.8中,在并发执行put操作时会发生数据覆盖的情况。

愿万事胜意 3万+

为什么HashMap线程安全

一、Map概述 我们都知道HashMap线程安全的,但是HashMap的使用频率在所有map中确实属于比较高的。因为它可以满足我们大多数的场景了。 Map类继承图 上面展示了java中Map的继承图,Map是一个接口,我们常用的实现类有HashMap、LinkedHashMap、TreeMap,HashTable。HashMap根据key的hashCode值来保存value,需要注意的是,HashMap保证遍历的顺序和插入的顺序是一致的。HashMap允许有一条记录的key为null,但

cuiqwei的博客 1万+

为什么HashMap线程安全?以及实现HashMap线程安全的解决方案

一、为什么HashMap线程安全? 1、JDK1.7 扩容引发的死循环和数据丢失 (1).当前jdk1.7版本的HashMap线程安全主要是发生在扩容函数中,其中调用了HshMap的transfer()方法 //jdk 1.7的transfer方法,HashMap的扩容操作 void transfer(Entry[] newTable, boolean rehash) { int newCapacity = newTable.length; for (Entry<K,V> e

Passer-Go 1万+

HashMap为什么线程安全

HashMap为什么线程安全

杨宇昌的博客 1万+

HashMap为什么线程安全的?

一直以来只是知道HashMap线程安全的,但是到底HashMap为什么线程安全多线程并发的时候在什么情况下可能出现问题? HashMap底层是一个Entry数组,当发生hash冲突的时候,hashmap是采用链表的方式来解决的,在对应的数组位置存放链表的头结点。对链表而言,新加入的节点会从头结点加入。 javadoc中关于hashmap的一段描述如下: 此实现是同步的。如果多个

mydreamongo的专栏 7万+

HashMap为什么线程安全

一直以来只是知道HashMap线程安全的,但是到底HashMap为什么线程安全多线程并发的时候在什么情况下可能出现问题? HashMap底层是一个Entry数组,当发生hash冲突的时候,hashmap是采用链表的方式来解决的,在对应的数组位置存放链表的头结点。对链表而言,新加入的节点会从头结点加入。 javadoc中关于hashmap的一段描述如下: 此实现是同步的。如果多个...

javafirst 5027

HashMap 为什么线程安全

前言:我们都知道HashMap线程安全的,在多线程环境中建议使用,但是其线程安全主要体现在什么地方呢,本文将对该问题进行解密。 1.jdk1.7中的HashMap HashMap 死循环是一个比较常见、比较经典的问题,在日常的面试中出现的频率比较高,所以接下来咱们通过图解的方式,带大家彻底理解死循环的原因。 前置知识 死循环问题发生在 JDK 1.7 版本中,造成这个问题主要是由于 HashMap 自身的运行机制,加上并发操作,从而导致了死循环。在 JDK 1.7 中 HashMap 的底层数据实现

青鸟飞鱼 4412

谈谈HashMap为什么线程安全的?

我们都知道HashMap线程安全的,在多线程环境中建议使用,应该使用ConcurrentHashMap,但是其线程安全体现在什么地方,可能并没有深入理解,本文将对该问题进行解密。

m0_55611144的博客 1万+

为什么HashMap线程安全的?

为什么HashMap线程安全的 一、Map概述 我们都知道HashMap线程安全的,但是HashMap的使用频率在所有map中确实属于比较高的。因为它可以满足我们大多数的场景了。 Map类继承图 上面展示了java中Map的继承图,Map是一个接口,我们常用的实现类有HashMap、LinkedHashMap、TreeMap,HashTable。HashMap根据key的hashCode...

qq_44575980的博客 1393
上一篇: Java 23种设计模式系列之——实战单例模式
下一篇: 在阿里和百度工作共七年,面试一个小公司却给挂了!
Java斗帝之路
博客等级 码龄6年 2390粉丝 687原创
评论 5
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值