您的位置：首页 > 编程语言 > Java开发

Java HashMap的工作原理

2015-03-12 21:53 183 查看

Java HashMap的工作原理

本文由转载自Java HashMap的工作原理

大概看了一下…jdk1.7和1.6的实现还不一样…

面试的时候经常会遇见诸如：“java中的HashMap是怎么工作的”，“HashMap的get和put内部的工作原理”这样的问题。本文将用一个简单的例子来解释下HashMap内部的工作原理。首先我们从一个例子开始，而不仅仅是从理论上，这样，有助于更好地理解，然后，我们来看下get和put到底是怎样工作的。

我们来看个非常简单的例子。有一个“国家”（Country）类，我们将要用Country对象作为key，它的首都的名字（String类型）作为value。下面的例子有助于我们理解key-value对在HashMap中是如何存储的。

//Country.java
public class Country {
String name;
long population;

public Country ( String name, long population ) {
this.name = name;

this.population = population;
}
public String getName () {
return name;
}
public void setName ( String name ) {
this.name = name;
}
public long getPopulation () {
return population;
}
public void setPopulation ( long population ) {
this.population = population;
}
@Override
public int hashCode () {
if ( name.length () % 2 == 0 ) {
return 31;
} else {
return 95;
}
}
@Override
public boolean equals ( Object o ) {
if ( this == o )    return true;
if ( ! ( o instanceof Country ) )    return false;
Country c = ( Country ) o;
return name.equalsIgnoreCase ( c.getName () );
}
}

如果想了解更多关于Object对象的hashCode和equals方法的东西，可以参考：java中的hashCode()和equals()方法

//HashMapStructure.java
import java.util.HashMap;
import java.util.Iterator;

public class HashMapStructure {
public static void main ( String[] args ) {
Country india = new Country ( "India", 1000 );
Country japan = new Country ( "Japan", 10000 );
Country france = new Country ( "France", 2000 );
Country russia = new Country ( "Russia", 20000 );
HashMap<Country, String> countryCapitalMap = new HashMap<Country, String>();
countryCapitalMap.put ( india, "Delhi" );
countryCapitalMap.put ( japan, "Tokyo" );
countryCapitalMap.put ( france, "Paris" );
countryCapitalMap.put ( russia, "Moscow" );
Iterator<Country> countryCapitalIter = countryCapitalMap.keySet().iterator();//put debug point at this line
while ( countryCapitalIter.hasNext() ) {
Country countryObj = countryCapitalIter.next ();
String capital = countryCapitalMap.get ( countryObj );
System.out.println ( countryObj.getName () + "----" + capital );
}
}
}

现在，在Iterator…这行设置一个断点，在项目上右击->调试运行->java应用。程序会停在这行，然后在countryCapitalMap上右击，选择“查看”（watch）。将会看到如下的结构：

从上图可以观察到以下几点：

1. 有一个叫做table大小是16的Entry数组。

2. 这个table数组存储了Entry类的对象。

HashMap类有一个叫做HashMapEntry的内部类实现了Entry接口。这个HashMapEntry类包含了key-value作为实例变量。我们看下HashMapEntry类的结构：

static class HashMapEntry<K, V> implements Entry<K, V> {
final K key;
V value;
final int hash;
HashMapEntry<K, V> next;
...//More code goes here
}

每当往hashmap里面存放key-value对的时候，都会为它们实例化一个Entry对象，这个Entry对象就会存储在前面提到的Entry数组table中。现在你一定很想知道，上面创建的Entry对象将会存放在具体哪个位置（在table中的精确位置）。答案就是，根据key的hashcode()方法计算出来的hash值（来决定）。hash值用来计算key在Entry数组的索引。

现在，如果你看上图数组的索引10，它有个HashMap$Entry的Entry对象。

我们往hashmap放了4个key-value对，但是看上去好像只有2个元素！！！这是因为，如果两个元素有相同的hashcode，他们会被放在同一个索引上。它是以链表（LinkedList）的形式来存储的（逻辑上）。

所以上面的country对象的key-value的hashcode值是如何计算出来的：

hashCode for Japan = 95，因为它的长度为奇数

hashCode for India = 95，因为它的长度为奇数

hashCode for Russia = 31，因为它的长度为偶数

hashCode for France = 31，因为它的长度为偶数

所以，现在假如你已经很好地了解了hashmap的结构，让我们看下put和get方法。

put

现在我们一步一步来看上面的代码。

对key做null检查。如果key是null，会被存储到table[0]，因为null的hash值总是0.

key的hashCode()方法会被调用，然后二次计算hash值。hash值用来找到存储Entry对象的数组的索引。有时候hash函数可能写的很不好，所以JDK的设计者添加了另外一个叫做hash()的方法，它接收刚才计算的hash值作为参数。如果你想了解更多关于hash()函数的东西，可以参考：hashmap中的hash和indexFor方法

然后for循环用来寻找有没hash值相同且key也equals的对象，如果有就会用当前Entry的value来替换之前value。

如果这时hashmap的size已经慢，就会将自身容量变为2倍

get

当你了解hashmap的put的工作原理了，理解get的工作原理就非常简单了。

对key进行null检查。如果key是null，那么将返回table[0]位置的元素。

根据key的hashCode()方法计算hash值。

然后根据hash值就确定在table数组的精确位置。

在确定索引之后，会迭代链表，判断key的引用是否相同，或者调用equals方法检查，如果为true，则返回Entry对象的value，否则，返回null。

要牢记以下关键点：

HashMap有一个叫做HashMapEntry的内部类，它用来存储key-vallue对。

上面的HashMapEntry对象是存储在一个叫做table的Entry数组中

table的索引在逻辑上叫做”桶“（bucket），它存储了链表的第一个元素。

key的hashCode()方法经过二次计算用来确定HashMapEntry对象所在的桶，即在table数组上的索引。

如果两个不同的key的hash值相同，它们会被放在table数组的同一个桶里。

key的equals方法用来确保key的唯一性。

先做搬运工…明天找时间按照上文所说动手练习一下。

内容来自用户分享和网络整理，不保证内容的准确性，如有侵权内容，可联系管理员处理

标签：

相关文章推荐

新的分享

章节导航