当前位置:首页 > 文章列表 > 文章 > java教程 > Java线程池CPU占用100%原因与解决方案

Java线程池CPU占用100%原因与解决方案

2025-05-01 09:54:08 0浏览 收藏
推广推荐
免费电影APP ➜
支持 PC / 移动端,安全直达

Java线程池导致CPU占用100%的原因及解决方案:在线上服务中发现容器的CPU使用率突然达到100%,即使下线后,Java进程CPU使用率依然居高不下。通过top和jstack命令,发现高CPU占用的线程由线程池创建,且64个线程中有24个处于可运行状态(runnable)。进一步分析发现,CPU主要消耗在LinkedBlockingQueue.poll方法上,可能是由于线程池配置问题,导致线程不断轮询任务队列。我们的线程池配置了maxPoolSize为64,corePoolSize为16,keepAliveTime为60秒。解决方案包括调整线程池大小、更换队列类型、排查代码、更换JDK及检查容器资源分配。

Java 线程池导致CPU占用100%的原因及排查方法

近日,我们在线上服务中发现了一个容器的CPU使用率突然达到100%,为了保障系统的稳定性,我们首先将该容器下线,停止新的流量进入。然而,即使没有新的请求,容器中的Java进程CPU使用率依然居高不下。随后,我们通过top命令检查各个线程的使用情况,发现高CPU占用的线程是由线程池创建的。

这引发了我们的疑问:既然容器已经下线,为何线程池还会持续执行任务?接着,我们使用jstack命令查看各个线程的堆栈情况,发现线程池中有64个线程,其中40个线程处于等待新任务的状态(waiting),而另外24个线程则处于可运行状态(runnable)。具体的可运行线程堆栈信息如下:

<code>"pool-1-thread-1" prio=10 tid=0x00007f9f5c01e800 nid=0x1a runnable [0x00007f9f54527000]
   java.lang.Thread.State: RUNNABLE
        at java.base/java.util.concurrent.LinkedBlockingQueue.poll(LinkedBlockingQueue.java:464)
        at java.base/java.util.concurrent.ThreadPoolExecutor.getTask(ThreadPoolExecutor.java:1056)
        at java.base/java.util.concurrent.ThreadPoolExecutor.runWorker(ThreadPoolExecutor.java:1118)
        at java.base/java.util.concurrent.ThreadPoolExecutor$Worker.run(ThreadPoolExecutor.java:628)
        at java.base/java.lang.Thread.run(Thread.java:834)</code>

从堆栈信息可以看出,这些可运行的线程正在尝试获取任务,但实际上并没有线程在执行任务。这非常奇怪,因为线程池中的线程在查询是否有新任务的操作应该非常快且短暂。理论上,线程池中的线程应该要么获取任务并执行任务中的代码,要么因为没有任务而陷入等待状态(waiting),只有极少数情况下会处于可运行状态并试图获取任务。不可能有40%的线程都处于这种状态。

为了进一步了解情况,我们生成并分析了Java进程的火焰图,发现CPU主要消耗在LinkedBlockingQueue.poll方法上,这与jstack的信息一致。我们开始怀疑可能是线程池的配置问题,导致线程不断轮询任务队列而无法进入等待状态(waiting)。经确认,我们的线程池配置了maxPoolSize为64,corePoolSize为16,当前线程池中的线程数量达到了最大值64。线程池还配置了keepAliveTime参数为60秒,这样如果线程在60秒内没有获取到任务,它会等待60秒钟,如果仍然没有任务,线程将终止直到线程数量减少到corePoolSize。我们使用Arthas查看LinkedBlockingQueue.poll的调用情况,但并没有发现它被频繁调用。

在这一步,我们的思路陷入了停滞,目前只能怀疑LinkedBlockingQueue.poll方法存在某些bug,导致获取不到任务时会陷入死循环。但考虑到这是JDK内部的代码,这种明显的bug应该是不太可能的。我们使用的JDK版本是zulu-17。是否有其他人遇到过类似的问题,提供一些提示和方向呢?

根据现有的信息,我们可以推测在调用poll()方法时需要获取takeLock。当大量线程同时调用poll()时,锁竞争不可避免。在这个过程中,没有获取到锁的线程会进行自旋等待操作,从而导致CPU占用率升高(仍然处于RUNNABLE状态),这也会使keepAliveTime失效,无法回收线程。

我们可以查看LinkedBlockingQueue.poll方法的实现:

<code>public E poll(long timeout, TimeUnit unit) throws InterruptedException {
    final E x;
    final int c;
    long nanos = unit.toNanos(timeout);
    final AtomicInteger count = this.count;
    final ReentrantLock takeLock = this.takeLock;
    takeLock.lockInterruptibly();
    try {
        while (count.get() == 0) {
            if (nanos  1)
            notEmpty.signal();
    } finally {
        takeLock.unlock();
    }
    if (c == capacity)
        signalNotFull();
    return x;
}</code>

基于以上分析,我们可以尝试以下几种解决方案:

  1. 调整线程池大小:将maxPoolSize从64调整到32,这样可以减少锁竞争。
  2. 更换队列类型:尝试使用ArrayBlockingQueue,这种队列的锁竞争开销较小,虽然吞吐量可能会有所下降。
  3. 排查代码:检查是否有提交了死循环任务,导致线程池中的线程无法正常结束。
  4. 更换JDK:尝试使用其他版本的JDK,看是否能解决问题。
  5. 检查容器资源分配:确保容器的资源分配充足,避免因资源不足导致的性能问题。

为什么Java线程池会导致CPU占用100%?如何排查和解决这个问题?

以上就是《Java线程池CPU占用100%原因与解决方案》的详细内容,更多关于的资料请关注golang学习网公众号!

lambda表达式怎么用及应用实例lambda表达式怎么用及应用实例
上一篇
lambda表达式怎么用及应用实例
在Debian系统中,`strings`命令是一个非常实用的工具,主要用于从二进制文件中提取可打印的字符串。以下是一些`strings`在实际项目中的应用:1.**逆向工程和恶意软件分析**:`strings`可以从可执行文件中提取文本字符串,帮助你快速了解程序功能或恶意软件行为。示例命令:`stringssuspicious_file>extracted_strings.txt`2.**调试和开
下一篇
在Debian系统中,`strings`命令是一个非常实用的工具,主要用于从二进制文件中提取可打印的字符串。以下是一些`strings`在实际项目中的应用:1.**逆向工程和恶意软件分析**:`strings`可以从可执行文件中提取文本字符串,帮助你快速了解程序功能或恶意软件行为。示例命令:`stringssuspicious_file>extracted_strings.txt`2.**调试和开
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • ChatExcel酷表:告别Excel难题,北大团队AI助手助您轻松处理数据
    ChatExcel酷表
    ChatExcel酷表是由北京大学团队打造的Excel聊天机器人,用自然语言操控表格,简化数据处理,告别繁琐操作,提升工作效率!适用于学生、上班族及政府人员。
    3206次使用
  • Any绘本:开源免费AI绘本创作工具深度解析
    Any绘本
    探索Any绘本(anypicturebook.com/zh),一款开源免费的AI绘本创作工具,基于Google Gemini与Flux AI模型,让您轻松创作个性化绘本。适用于家庭、教育、创作等多种场景,零门槛,高自由度,技术透明,本地可控。
    3419次使用
  • 可赞AI:AI驱动办公可视化智能工具,一键高效生成文档图表脑图
    可赞AI
    可赞AI,AI驱动的办公可视化智能工具,助您轻松实现文本与可视化元素高效转化。无论是智能文档生成、多格式文本解析,还是一键生成专业图表、脑图、知识卡片,可赞AI都能让信息处理更清晰高效。覆盖数据汇报、会议纪要、内容营销等全场景,大幅提升办公效率,降低专业门槛,是您提升工作效率的得力助手。
    3448次使用
  • 星月写作:AI网文创作神器,助力爆款小说速成
    星月写作
    星月写作是国内首款聚焦中文网络小说创作的AI辅助工具,解决网文作者从构思到变现的全流程痛点。AI扫榜、专属模板、全链路适配,助力新人快速上手,资深作者效率倍增。
    4557次使用
  • MagicLight.ai:叙事驱动AI动画视频创作平台 | 高效生成专业级故事动画
    MagicLight
    MagicLight.ai是全球首款叙事驱动型AI动画视频创作平台,专注于解决从故事想法到完整动画的全流程痛点。它通过自研AI模型,保障角色、风格、场景高度一致性,让零动画经验者也能高效产出专业级叙事内容。广泛适用于独立创作者、动画工作室、教育机构及企业营销,助您轻松实现创意落地与商业化。
    3826次使用
微信登录更方便
  • 密码登录
  • 注册账号
登录即同意 用户协议隐私政策
返回登录
  • 重置密码