当前位置:首页 > 文章列表 > 文章 > java教程 > HashSet与TreeSet区别详解

HashSet与TreeSet区别详解

2026-01-23 21:36:42 0浏览 收藏

偷偷努力,悄无声息地变强,然后惊艳所有人!哈哈,小伙伴们又来学习啦~今天我将给大家介绍《HashSet与TreeSet性能对比分析》,这篇文章主要会讲到等等知识点,不知道大家对其都有多少了解,下面我们就一起来看一吧!当然,非常希望大家能多多评论,给出合理的建议,我们一起学习,一起进步!

HashSet插入和查找通常比TreeSet快,因其基于哈希表实现,平均时间复杂度O(1),而TreeSet基于红黑树,操作均为O(log n);但哈希碰撞严重时HashSet可能退化。

Java集合框架中的HashSet与TreeSet性能比较

HashSet插入和查找为什么通常比TreeSet快

因为 HashSet 底层用哈希表(HashMap)实现,平均时间复杂度是 O(1);而 TreeSet 基于红黑树,所有操作都是 O(log n)。只要哈希函数分布均匀、负载因子不过高,HashSet 的散列定位几乎不随数据量增长变慢。

但要注意:哈希碰撞多时(比如大量 String 具有相同 hashCode()),HashSet 会退化为链表甚至红黑树(JDK 8+),此时单次操作可能接近 O(n) 或 O(log n) —— 这不是常态,但真实业务中若对象重写了弱 hashCode(),就容易踩中。

  • HashSet 不保证顺序,也不支持范围查询
  • TreeSet 自动按自然序或自定义 Comparator 排序,能高效做 headSet()、tailSet()、subSet()
  • 如果只做“是否存在”判断且不要求有序,HashSet 几乎总是更优

TreeSet在什么场景下性能不可替代

当你需要动态维护一个有序集合,并频繁执行以下操作时,TreeSet 的 O(log n) 是刚性需求,HashSet 完全无法替代:

  • 找最小/最大元素(first() / last())—— O(1),而 HashSet 得遍历
  • 取前 K 小元素(用 iterator() 遍历前 K 个)—— O(K),HashSet 无序,必须先转 List 再排序,O(n log n)
  • 判断某值是否在某个区间内(subSet(from, to))—— O(log n + size),HashSet 只能全量扫描

例如实时风控中维护“最近 5 分钟的请求时间戳”,用 TreeSet 可以快速 tailSet(System.currentTimeMillis() - 300_000) 拿到有效集合,不用每次清空重建。

实测差异有多大:一个典型插入基准对比

插入 100 万个 Integer 对象(无重复),JDK 17 下典型结果:

HashSet: ~45 ms
TreeSet: ~120 ms

差距约 2–3 倍,且随着数据量增大,TreeSet 的对数增长仍稳定,而 HashSet 在扩容重哈希时会有偶发毛刺(如从 2^20 扩容到 2^21)。

但如果插入的是自定义对象,且 hashCode() 实现低效(比如反复拼接字符串再 hashCode()),HashSet 可能反而更慢;而 TreeSet 只依赖 compareTo() 或 Comparator,逻辑清晰可控。

  • 别只看理论复杂度,实测要覆盖你的实际数据特征
  • 避免在 hashCode() 或 compareTo() 中做 I/O、同步、复杂计算
  • TreeSet 的内存占用略高(每个节点含红黑树指针),大数据量时需留意

迭代性能谁更快

单纯遍历全部元素,HashSet 通常略快(哈希桶数组顺序遍历),但差别微小;真正影响体验的是“遍历是否有序”:

  • 如果你需要升序遍历结果,用 TreeSet 迭代是免费的(已排序);用 HashSet 则必须额外 new ArrayList(set).sort(),成本是 O(n log n)
  • TreeSet.iterator() 返回的是“有序视图”,不复制数据,但底层红黑树遍历有指针跳转开销,局部性不如数组
  • 并发环境下二者都不安全;若需线程安全的有序集合,ConcurrentSkipListSet 是更合适的选择,而非包装 TreeSet

最常被忽略的一点:TreeSet 的 iterator() 是 fail-fast 的,但它的结构性修改(如 add())不会影响正在迭代的其他线程——这点和 HashSet 一致;但很多人误以为“有序=线程安全”,结果在线上出现 ConcurrentModificationException 却查不到源头。

理论要掌握,实操不能落!以上关于《HashSet与TreeSet区别详解》的详细介绍,大家都掌握了吧!如果想要继续提升自己的能力,那么就来关注golang学习网公众号吧!

百度网盘任务扩容攻略及清单详解百度网盘任务扩容攻略及清单详解
上一篇
百度网盘任务扩容攻略及清单详解
Win8触摸屏校准技巧与故障处理
下一篇
Win8触摸屏校准技巧与故障处理
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • PubMedQA数据集详解:生物医学问答基准、功能与应用指南
    PubMedQA
    深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
    375次使用
  • H2O EvalGPT:开源LLM大模型评估与排行榜工具
    H2O EvalGPT
    H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
    445次使用
  • LMArena是什么?伯克利AI模型评估平台使用指南与功能解析
    LMArena
    LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
    452次使用
  • 斯坦福HELM:大语言模型Holistic Evaluation整体评估框架详解
    HELM
    深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
    398次使用
  • MMBench详解:多模态大模型基准测试、功能特点与使用指南
    MMBench
    MMBench是由上海人工智能实验室等机构联合推出的多模态基准测试平台,提供细粒度能力评估、大规模数据集及VLMEvalKit工具。本文详细介绍其核心功能、安装使用方法及应用场景,助力开发者全面评估多模态模型性能。
    223次使用
微信登录更方便
  • 密码登录
  • 注册账号
登录即同意 用户协议 和 隐私政策
返回登录
  • 重置密码