最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

Java的ConcurrentHashMap原理深入分析

 更新時間:2023年07月24日 10:46:06   作者:微wx笑  
這篇文章主要介紹了Java的ConcurrentHashMap原理深入分析,集合是編程中最常用的數據結構,而談到并發(fā),幾乎總是離不開集合這類高級數據結構的支持,需要的朋友可以參考下

ConcurrentHashMap集合

集合是編程中最常用的數據結構。而談到并發(fā),幾乎總是離不開集合這類高級數據結構的支持。

比如兩個線程需要同時訪問一個中間臨界區(qū)(Queue),比如常會用緩存作為外部文件的副本(HashMap)。這篇文章主要分析jdk1.5的3種并發(fā)集合類型(concurrent,copyonright,queue)中的ConcurrentHashMap,讓我們從原理上細致的了解它們,能夠讓我們在深度項目開發(fā)中獲益非淺。

通過分析Hashtable就知道,synchronized是針對整張Hash表的,即每次鎖住整張表讓線程獨占,ConcurrentHashMap允許多個修改操作并發(fā)進行,其關鍵在于使用了鎖分離技術。它使用了多個鎖來控制對hash表的不同部分進行的修改。ConcurrentHashMap內部使用段(Segment)來表示這些不同的部分,每個段其實就是一個小的hash table,它們有自己的鎖。只要多個修改操作發(fā)生在不同的段上,它們就可以并發(fā)進行。

有些方法需要跨段,比如size()和containsValue(),它們可能需要鎖定整個表而而不僅僅是某個段,這需要按順序鎖定所有段,操作完畢后,又按順序釋放所有段的鎖。這里“按順序”是很重要的,否則極有可能出現死鎖,在ConcurrentHashMap內部,段數組是final的,并且其成員變量實際上也是final的,但是,僅僅是將數組聲明為final的并不保證數組成員也是final的,這需要實現上的保證。這可以確保不會出現死鎖,因為獲得鎖的順序是固定的。

一、結構解析

ConcurrentHashMap和Hashtable主要區(qū)別就是圍繞著鎖的粒度以及如何鎖,可以簡單理解成把一個大的HashTable分解成多個,形成了鎖分離。如圖:

而Hashtable的實現方式是鎖整個hash表

二、應用場景

當有一個大數組時需要在多個線程共享時就可以考慮是否把它給分層多個節(jié)點了,避免大鎖。并可以考慮通過hash算法進行一些模塊定位。

其實不止用于線程,當設計數據表的事務時(事務某種意義上也是同步機制的體現),可以把一個表看成一個需要同步的數組,如果操作的表數據太多時就可以考慮事務分離了(這也是為什么要避免大表的出現),比如把數據進行字段拆分,水平分表等.

三、源碼解讀

 ConcurrentHashMap中主要實體類就是三個:ConcurrentHashMap(整個Hash表),Segment(桶),HashEntry(節(jié)點),對應上面的圖可以看出之間的關系

/** 
* The segments, each of which is a specialized hash table 
*/  
final Segment<K,V>[] segments; 

可以看到除了value不是final的,其它值都是final的,這意味著不能從hash鏈的中間或尾部添加或刪除節(jié)點,因為這需要修改next 引用值,所有的節(jié)點的修改只能從頭部開始。對于put操作,可以一律添加到Hash鏈的頭部。但是對于remove操作,可能需要從中間刪除一個節(jié)點,這就需要將要刪除節(jié)點的前面所有節(jié)點整個復制一遍,最后一個節(jié)點指向要刪除結點的下一個結點。

這在講解刪除操作時還會詳述。為了確保讀操作能夠看到最新的值,將value設置成volatile,這避免了加鎖。

為了加快定位段以及段中hash槽的速度,每個段hash槽的的個數都是2^n,這使得通過位運算就可以定位段和段中hash槽的位置。當并發(fā)級別為默認值16時,也就是段的個數,hash值的高4位決定分配在哪個段中。但是我們也不要忘記《算法導論》給我們的教訓:hash槽的的個數不應該是 2^n,這可能導致hash槽分配不均,這需要對hash值重新再hash一次。(這段似乎有點多余了 )

這是定位段的方法:

final Segment<K,V> segmentFor(int hash) {  
    return segments[(hash >>> segmentShift) & segmentMask];  
}

數據結構

關于Hash表的基礎數據結構,這里不想做過多的探討。Hash表的一個很重要方面就是如何解決hash沖突,ConcurrentHashMap 和HashMap使用相同的方式,都是將hash值相同的節(jié)點放在一個hash鏈中。與HashMap不同的是,ConcurrentHashMap使用多個子Hash表,也就是段(Segment)。下面是ConcurrentHashMap的數據成員:

 public class ConcurrentHashMap<K, V> extends AbstractMap<K, V>  
         implements ConcurrentMap<K, V>, Serializable {  
     /** 
      * Mask value for indexing into segments. The upper bits of a 
      * key's hash code are used to choose the segment. 
      */  
     final int segmentMask;  
     /** 
      * Shift value for indexing within segments. 
      */  
     final int segmentShift;  
     /** 
      * The segments, each of which is a specialized hash table 
      */  
     final Segment<K,V>[] segments;  
 } 

所有的成員都是final的,其中segmentMask和segmentShift主要是為了定位段,參見上面的segmentFor方法。
每個Segment相當于一個子Hash表,它的數據成員如下:

     static final class Segment<K,V> extends ReentrantLock implements Serializable {  
 private static final long serialVersionUID = 2249069246763182397L;  
         /** 
          * The number of elements in this segment's region. 
          */  
         transient volatile int count;  
         /** 
          * Number of updates that alter the size of the table. This is 
          * used during bulk-read methods to make sure they see a 
          * consistent snapshot: If modCounts change during a traversal 
          * of segments computing size or checking containsValue, then 
          * we might have an inconsistent view of state so (usually) 
          * must retry. 
          */  
         transient int modCount;  
         /** 
          * The table is rehashed when its size exceeds this threshold. 
          * (The value of this field is always <tt>(int)(capacity * 
          * loadFactor)</tt>.) 
          */  
         transient int threshold;  
         /** 
          * The per-segment table. 
          */  
         transient volatile HashEntry<K,V>[] table;  
         /** 
          * The load factor for the hash table.  Even though this value 
          * is same for all segments, it is replicated to avoid needing 
          * links to outer object. 
          * @serial 
          */  
         final float loadFactor;  
 } 

count用來統(tǒng)計該段數據的個數,它是volatile,它用來協調修改和讀取操作,以保證讀取操作能夠讀取到幾乎最新的修改。

協調方式是這樣的,每次修改操作做了結構上的改變,如增加/刪除節(jié)點(修改節(jié)點的值不算結構上的改變),都要寫count值,每次讀取操作開始都要讀取count的值。

這利用了 Java 5中對volatile語義的增強,對同一個volatile變量的寫和讀存在happens-before關系。

  • modCount統(tǒng)計段結構改變的次數,主要是為了檢測對多個段進行遍歷過程中某個段是否發(fā)生改變,在講述跨段操作時會還會詳述。
  • threashold用來表示需要進行rehash的界限值。
  • table數組存儲段中節(jié)點,每個數組元素是個hash鏈,用HashEntry表示。
  • table也是volatile,這使得能夠讀取到最新的 table值而不需要同步。
  • loadFactor表示負載因子。

先來看下刪除操作remove(key)。

 public V remove(Object key) {  
  hash = hash(key.hashCode());  
     return segmentFor(hash).remove(key, hash, null);  
 }  
//整個操作是先定位到段,然后委托給段的remove操作。當多個刪除操作并發(fā)進行時,只要它們所在的段不相同,它們就可以同時進行。下面是Segment的remove方法實現:
 V remove(Object key, int hash, Object value) {  
     lock();  
     try {  
         int c = count - 1;  
         HashEntry<K,V>[] tab = table;  
         int index = hash & (tab.length - 1);  
         HashEntry<K,V> first = tab[index];  
         HashEntry<K,V> e = first;  
         while (e != null && (e.hash != hash || !key.equals(e.key)))  
             e = e.next;  
         V oldValue = null;  
         if (e != null) {  
             V v = e.value;  
             if (value == null || value.equals(v)) {  
                 oldValue = v;  
                 // All entries following removed node can stay  
                 // in list, but all preceding ones need to be  
                 // cloned.  
                 ++modCount;  
                 HashEntry<K,V> newFirst = e.next;  
                 *for (HashEntry<K,V> p = first; p != e; p = p.next)  
                     *newFirst = new HashEntry<K,V>(p.key, p.hash,  
                                                   newFirst, p.value);  
                 tab[index] = newFirst;  
                 count = c; // write-volatile  
             }  
         }  
         return oldValue;  
     } finally {  
         unlock();  
     }  
 } 

整個操作是在持有段鎖的情況下執(zhí)行的,空白行之前的行主要是定位到要刪除的節(jié)點e。接下來,如果不存在這個節(jié)點就直接返回null,否則就要將e前面的結點復制一遍,尾結點指向e的下一個結點。e后面的結點不需要復制,它們可以重用。

中間那個for循環(huán)是做什么用的呢?(*號標記)從代碼來看,就是將定位之后的所有entry克隆并拼回前面去,但有必要嗎?每次刪除一個元素就要將那之前的元素克隆一遍?這點其實是由entry的不變性來決定的,仔細觀察entry定義,發(fā)現除了value,其他所有屬性都是用final來修飾的,這意味著在第一次設置了next域之后便不能再改變它,取而代之的是將它之前的節(jié)點全都克隆一次。至于entry為什么要設置為不變性,這跟不變性的訪問不需要同步從而節(jié)省時間有關

下面是個示意圖

刪除元素之前:

刪除元素3之后:

第二個圖其實有點問題,復制的結點中應該是值為2的結點在前面,值為1的結點在后面,也就是剛好和原來結點順序相反,還好這不影響我們的討論。

整個remove實現并不復雜,但是需要注意如下幾點。

  • 第一,當要刪除的結點存在時,刪除的最后一步操作要將count的值減一。這必須是最后一步操作,否則讀取操作可能看不到之前對段所做的結構性修改。
  • 第二,remove執(zhí)行的開始就將table賦給一個局部變量tab,這是因為table是 volatile變量,讀寫volatile變量的開銷很大。編譯器也不能對volatile變量的讀寫做任何優(yōu)化,直接多次訪問非volatile實例變量沒有多大影響,編譯器會做相應優(yōu)化。

接下來看put操作,同樣地put操作也是委托給段的put方法。

下面是段的put方法:

 V put(K key, int hash, V value, boolean onlyIfAbsent) {  
     lock();  
     try {  
         int c = count;  
         if (c++ > threshold) // ensure capacity  
             rehash();  
         HashEntry<K,V>[] tab = table;  
         int index = hash & (tab.length - 1);  
         HashEntry<K,V> first = tab[index];  
         HashEntry<K,V> e = first;  
         while (e != null && (e.hash != hash || !key.equals(e.key)))  
             e = e.next;  
         V oldValue;  
         if (e != null) {  
             oldValue = e.value;  
             if (!onlyIfAbsent)  
                 e.value = value;  
         }  
         else {  
             oldValue = null;  
             ++modCount;  
             tab[index] = new HashEntry<K,V>(key, hash, first, value);  
             count = c; // write-volatile  
         }  
         return oldValue;  
     } finally {  
         unlock();  
     }  
 }

該方法也是在持有段鎖(鎖定整個segment)的情況下執(zhí)行的,這當然是為了并發(fā)的安全,修改數據是不能并發(fā)進行的,必須得有個判斷是否超限的語句以確保容量不足時能夠rehash。

接著是找是否存在同樣一個key的結點,如果存在就直接替換這個結點的值。

否則創(chuàng)建一個新的結點并添加到hash鏈的頭部,這時一定要修改modCount和count的值,同樣修改count的值一定要放在最后一步。

put方法調用了rehash方法,reash方法實現得也很精巧,主要利用了table的大小為2^n,這里就不介紹了。

而比較難懂的是這句int index = hash & (tab.length - 1),原來segment里面才是真正的hashtable,即每個segment是一個傳統(tǒng)意義上的hashtable,如上圖,從兩者的結構就可以看出區(qū)別,這里就是找出需要的entry在table的哪一個位置,之后得到的entry就是這個鏈的第一個節(jié)點,如果e!=null,說明找到了,這是就要替換節(jié)點的值(onlyIfAbsent == false),否則,我們需要new一個entry,它的后繼是first,而讓tab[index]指向它,什么意思呢?

實際上就是將這個新entry插入到鏈頭,剩下的就非常容易理解了

修改操作還有putAll和replace。putAll就是多次調用put方法,沒什么好說的。replace甚至不用做結構上的更改,實現要比put和delete要簡單得多

理解了put和delete,理解replace就不在話下了,這里也不介紹了。

獲取操作

首先看下get操作,同樣ConcurrentHashMap的get操作是直接委托給Segment的get方法,直接看Segment的get方法:

 V get(Object key, int hash) {  
     if (count != 0) { // read-volatile 當前桶的數據個數是否為0 
         HashEntry<K,V> e = getFirst(hash);  得到頭節(jié)點
         while (e != null) {  
             if (e.hash == hash && key.equals(e.key)) {  
                 V v = e.value;  
                 if (v != null)  
                     return v;  
                 return readValueUnderLock(e); // recheck  
             }  
             e = e.next;  
         }  
     }  
     return null;  
 }

get操作不需要鎖。第一步是訪問count變量,這是一個volatile變量,由于所有的修改操作在進行結構修改時都會在最后一步寫count 變量,通過這種機制保證get操作能夠得到幾乎最新的結構更新。

對于非結構更新,也就是結點值的改變,由于HashEntry的value變量是 volatile的,也能保證讀取到最新的值。接下來就是根據hash和key對hash鏈進行遍歷找到要獲取的結點,如果沒有找到,直接訪回null。

對hash鏈進行遍歷不需要加鎖的原因在于鏈指針next是final的。

但是頭指針卻不是final的,這是通過getFirst(hash)方法返回,也就是存在 table數組中的值。

這使得getFirst(hash)可能返回過時的頭結點,例如,當執(zhí)行get方法時,剛執(zhí)行完getFirst(hash)之后,另一個線程執(zhí)行了刪除操作并更新頭結點

這就導致get方法中返回的頭結點不是最新的。這是可以允許,通過對count變量的協調機制,get能讀取到幾乎最新的數據,雖然可能不是最新的。

要得到最新的數據,只有采用完全的同步。

最后,如果找到了所求的結點,判斷它的值如果非空就直接返回,否則在有鎖的狀態(tài)下再讀一次。

這似乎有些費解,理論上結點的值不可能為空,這是因為 put的時候就進行了判斷,如果為空就要拋NullPointerException。

空值的唯一源頭就是HashEntry中的默認值,因為 HashEntry中的value不是final的,非同步讀取有可能讀取到空值。

仔細看下put操作的語句:tab[index] = new HashEntry<K,V>(key, hash, first, value)

在這條語句中,HashEntry構造函數中對value的賦值以及對tab[index]的賦值可能被重新排序,這就可能導致結點的值為空。

這里當v為空時,可能是一個線程正在改變節(jié)點,而之前的get操作都未進行鎖定,根據bernstein條件,讀后寫或寫后讀都會引起數據的不一致

所以這里要對這個e重新上鎖再讀一遍,以保證得到的是正確值。

 V readValueUnderLock(HashEntry<K,V> e) {  
     lock();  
     try {  
         return e.value;  
     } finally {  
         unlock();  
     }  
 }

另一個操作是containsKey,這個實現就要簡單得多了,因為它不需要讀取值:

 boolean containsKey(Object key, int hash) {  
     if (count != 0) { // read-volatile  
         HashEntry<K,V> e = getFirst(hash);  
         while (e != null) {  
             if (e.hash == hash && key.equals(e.key))  
                 return true;  
             e = e.next;  
         }  
     }  
     return false;  
 }

到此這篇關于Java的ConcurrentHashMap原理深入分析的文章就介紹到這了,更多相關Java的ConcurrentHashMap內容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關文章希望大家以后多多支持腳本之家!

相關文章

  • java類比C++的STL庫詳解

    java類比C++的STL庫詳解

    這篇文章主要介紹了java類比C++的STL庫詳解,標準模板庫,是C++標準庫的重要組成部分,中文可譯為標準模板庫或者泛型庫,其包含有大量的模板類和模板函數,STL 是一些容器、算法和其他一些組件的集合,需要的朋友可以參考下
    2023-08-08
  • java IP地址網段計算的示例代碼

    java IP地址網段計算的示例代碼

    這篇文章主要介紹了java IP地址網段計算的示例代碼,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友們下面隨著小編來一起學習學習吧
    2020-03-03
  • Java基于注解的Excel導出方式

    Java基于注解的Excel導出方式

    這篇文章主要介紹了Java基于注解的Excel導出方式,具有很好的參考價值,希望對大家有所幫助。如有錯誤或未考慮完全的地方,望不吝賜教
    2023-01-01
  • Java利用自定義注解、反射實現簡單BaseDao實例

    Java利用自定義注解、反射實現簡單BaseDao實例

    下面小編就為大家?guī)硪黄狫ava利用自定義注解、反射實現簡單BaseDao實例。小編覺得挺不錯的,現在就分享給大家,也給大家做個參考。一起跟隨小編過來看看吧
    2017-08-08
  • Java+swing實現抖音上的表白程序詳解

    Java+swing實現抖音上的表白程序詳解

    這篇文章主要為大家詳細介紹了如何利用Java?swing實現抖音上的表白程序,文中的示例代碼講解詳細,感興趣的小伙伴可以跟隨小編一起學習一下
    2022-06-06
  • Java基礎教程之對象的方法與數據成員

    Java基礎教程之對象的方法與數據成員

    這篇文章主要介紹了Java基礎教程之對象的方法與數據成員,本文講解對象的方法與數據成員相關知識,因為java是面向對象語言,本文的知識都是經常要用到的,需要的朋友可以參考下
    2014-08-08
  • SpringBoot中使用@Async注解失效場景及說明

    SpringBoot中使用@Async注解失效場景及說明

    在Spring?Boot中,@Async注解就像一把刀,能幫你輕松處理那些耗時的任務,讓主線程可以繼續(xù)忙別的事兒,不過,跟所有強大的工具一樣,用不好它也可能出岔子,為了避免這些坑,咱們得深入了解下@Async注解,接下來,咱們就來聊聊7種常見的@Async失效情況,需要的朋友可以參考下
    2024-07-07
  • Spring MVC全局異常實例詳解

    Spring MVC全局異常實例詳解

    這篇文章主要給大家介紹了關于Spring MVC全局異常的相關資料,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友們下面隨著小編來一起學習學習吧。
    2018-02-02
  • SpringBoot接受前臺參數的6種方式以及統(tǒng)一響應代碼示例

    SpringBoot接受前臺參數的6種方式以及統(tǒng)一響應代碼示例

    這篇文章主要給大家介紹了關于SpringBoot接受前臺參數的6種方式以及統(tǒng)一響應的相關資料,前端負責展示頁面和用戶交互,而后端則負責處理業(yè)務邏輯和數據存儲,在這種架構下前端需要將用戶輸入的數據發(fā)送給后端進行處理,需要的朋友可以參考下
    2023-12-12
  • Java中Scanner使用方式:單行/多行輸入

    Java中Scanner使用方式:單行/多行輸入

    這篇文章主要介紹了Java中Scanner使用方式:單行/多行輸入,具有很好的參考價值,希望對大家有所幫助。如有錯誤或未考慮完全的地方,望不吝賜教
    2022-05-05

最新評論

余姚市| 密山市| 兴仁县| 龙岩市| 宕昌县| 开阳县| 汶川县| 海南省| 武隆县| 遂平县| 庆安县| 玛曲县| 得荣县| 惠来县| 凌海市| 华坪县| 杭州市| 湾仔区| 湄潭县| 白城市| 昭苏县| 武城县| 囊谦县| 石狮市| 萨迦县| 岳西县| 九龙坡区| 穆棱市| 贵德县| 长泰县| 西昌市| 彩票| 呼伦贝尔市| 罗源县| 兴安县| 石泉县| 香港 | 兰考县| 清水河县| 张家界市| 印江|