当前位置:首页 > 文章列表 > 文章 > java教程 > 在Java里HashMap存取数据的基本流程_Java哈希映射原理说明

在Java里HashMap存取数据的基本流程_Java哈希映射原理说明

2026-05-04 22:49:38 0浏览 收藏

本篇文章向大家介绍《在Java里HashMap存取数据的基本流程_Java哈希映射原理说明》,主要包括,具有一定的参考价值,需要的朋友可以参考一下。

put()先判null键存table[0],否则扰动hash、位运算算下标,空桶直插,否则遍历链表/树用equals()比key;get()性能取决于哈希分布,最理想O(1),冲突时链表O(n/2)、红黑树O(log n);链表≥8且数组≥64才树化,退化阈值为6;null键唯一且固定table[0],扩容触发rehash,遍历首选entrySet()。

在Java里HashMap存取数据的基本流程_Java哈希映射原理说明

put() 是怎么把键值对塞进数组里的

调用 put(key, value) 时,HashMap 不是直接往数组里一扔就完事。它会先判断 key 是否为 null:如果是,强制存到 table[0] 链表头;否则走标准哈希流程。

  • 调用 key.hashCode() 得到原始哈希码
  • 经扰动函数处理:(h = key.hashCode()) ^ (h >>> 16),让高位参与运算,减少低位冲突
  • 用位运算算下标:index = (table.length - 1) & hash(要求 table.length 是 2 的幂)
  • 若 table[index] 为空,新建 Node 直接放入;否则遍历链表或红黑树,用 equals() 比较 key —— 注意:只在 hash 相同的前提下才触发 equals()

get() 查数据为什么不是 O(1) 就一定快

get(key) 看似一步到位,但实际性能高度依赖哈希分布和冲突处理。它先算出 index,再在对应桶里线性查找(链表)或二分查找(红黑树)。

  • 最理想:无冲突 → 直接 table[index] 取值 → 真·O(1)
  • 常见情况:链表长度 ≤ 7 → 逐个 equals() 对比 → 平均 O(n/2),n 是链表长
  • 恶化情况:链表转红黑树后仍频繁命中同一桶 → 退化为 O(log n),但比 O(n) 好
  • 致命陷阱:若自定义 key 类没重写 hashCode() 和 equals(),或两者逻辑不一致,get() 可能永远找不到已存的值

为什么链表要升级成红黑树,且阈值是 8

这个设计是空间与时间的权衡结果。JDK 8 引入红黑树,不是为了“更炫”,而是解决极端哈希碰撞下的性能雪崩。

  • 链表查找平均 O(n/2),最坏 O(n);红黑树稳定在 O(log n)
  • 阈值设为 8:基于泊松分布统计,当负载因子 0.75 时,链表长度 ≥ 8 的概率 ≈ 0.00000006,极低 → 升级是小概率事件,不常触发
  • 但必须同时满足两个条件才升级:链表长度 ≥ 8 且 table.length ≥ 64;否则先扩容,避免过早树化浪费内存
  • 反向操作:当树中节点 ≤ 6 时,自动退化回链表 —— 树结构有额外指针开销,短数据没必要

新手最容易忽略的三个底层细节

很多 bug 不是语法错,而是对 HashMap “信任过头”导致的隐性失效。

  • null 键只能有一个,且永远落在 table[0];但 null 值可以无限多个 —— 如果业务逻辑依赖 “null 值代表未初始化”,得自己加 guard
  • 扩容不是静默的:当 size > capacity × loadFactor(默认 0.75),会触发 resize(),重建整个 table 数组并 rehash 所有元素 —— 此刻并发 put() 可能引发死循环(JDK 7)或数据丢失(JDK 8+ 修复但仍有风险)
  • 遍历时用 entrySet() 而非 keySet() + get():后者每次 get() 都重新算 hash、找桶、查链表,性能差一倍以上

真正卡住人的,往往不是“会不会用 put/get”,而是某次线上 get() 返回 null 时,你得立刻判断:是真没这个 key?是 key 的 hashCode() 实现错了?还是刚被另一个线程 resize 中断了?—— 这些都藏在那行看似简单的 map.get("uid") 后面。

今天带大家了解了的相关知识,希望对你有所帮助;关于文章的技术知识我们会一点点深入介绍,欢迎大家关注golang学习网公众号,一起学习编程~

html怎么制作简单的计算器_html表单计算器实例html怎么制作简单的计算器_html表单计算器实例
上一篇
html怎么制作简单的计算器_html表单计算器实例
详解Java中的Reference.reachabilityFence_Java 9提供的防止对象被过早回收
下一篇
详解Java中的Reference.reachabilityFence_Java 9提供的防止对象被过早回收
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • PubMedQA数据集详解:生物医学问答基准、功能与应用指南
    PubMedQA
    深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
    253次使用
  • H2O EvalGPT:开源LLM大模型评估与排行榜工具
    H2O EvalGPT
    H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
    298次使用
  • LMArena是什么?伯克利AI模型评估平台使用指南与功能解析
    LMArena
    LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
    270次使用
  • 斯坦福HELM:大语言模型Holistic Evaluation整体评估框架详解
    HELM
    深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
    250次使用
  • MMBench详解:多模态大模型基准测试、功能特点与使用指南
    MMBench
    MMBench是由上海人工智能实验室等机构联合推出的多模态基准测试平台,提供细粒度能力评估、大规模数据集及VLMEvalKit工具。本文详细介绍其核心功能、安装使用方法及应用场景,助力开发者全面评估多模态模型性能。
    54次使用