当前位置:首页 > 文章列表 > Golang > Go教程 > Go sync.WaitGroup 内存泄露问题解析

Go sync.WaitGroup 内存泄露问题解析

2026-05-15 08:21:50 0浏览 收藏
Go 中的 sync.WaitGroup 本身不会直接造成内存泄漏,但它极易掩盖真正的 goroutine 泄漏问题:当 Add 与 Done 调用不匹配(如 panic、提前返回导致 Done 未执行),或 goroutine 在任务中无限阻塞时,wg.Wait() 将永久挂起,使大量 goroutine 及其默认至少 2KB 的栈内存持续驻留,最终引发内存持续增长和 OOM 崩溃;文中深入剖析了典型错误模式(如 defer wg.Done() 在 panic 时失效)、安全修复方案(结合 recover 的统一 defer),并推荐更健壮的替代方案 errgroup.Group,帮助开发者从根本上规避这类隐蔽而致命的资源泄漏风险。

WaitGroup 不是内存泄漏的直接原因,但它会掩盖 goroutine 泄漏,让泄漏更难被发现、更难被回收——最终表现为内存持续上涨、OOM 崩溃。

WaitGroup.Add 和 Done 调用不匹配

这是最常见也最隐蔽的问题:Add(1) 了,但某个 goroutine 因 panic、提前 return 或逻辑跳过,没走到 Done()。结果 wg.Wait() 永远阻塞,所有已启动的 goroutine 都卡在那儿不动,栈内存(2KB 起)持续累积。

  • 典型错误写法:go func() { defer wg.Done(); doWork() }() —— 如果 doWork() panic,defer wg.Done() 根本不会执行
  • 正确做法:把 recover 和 Done 绑定在同一个 defer 里:defer func() { if r := recover(); r != nil { /* log */ } wg.Done() }()
  • 更稳妥方式:改用 errgroup.Group,它自动处理 panic + Done + 上下文取消,不用手写

goroutine 内部阻塞导致 WaitGroup 无法退出

WaitGroup 只管“计数归零”,不管 goroutine 是否还活着。如果 goroutine 卡在 、select {}、time.Sleep 或网络等待上,Done() 永远不会被调用,wg.Wait() 就永远等下去。

  • 例如:go func() { wg.Add(1); —— 这个 goroutine 启动即永久阻塞,wg.Add(1) 还在函数体外,根本没进 goroutine,更别说 Done()
  • 修复关键:所有可能阻塞的操作,必须包裹在 select 中监听 ctx.Done(),并在收到时主动 return
  • 别依赖 runtime.GC() —— 它对卡住的 goroutine 无效,栈内存不会被回收

WaitGroup 被跨 goroutine 复用或误共享

WaitGroup 不是线程安全的“可复制对象”。把它作为值传递(比如方法接收者是 WaitGroup 而非 *WaitGroup),会导致每个 goroutine 操作的是自己的副本,wg.Wait() 永远等不到真实计数归零。

  • 错误示例:func (wg WaitGroup) Do() { wg.Add(1); go func() { wg.Done() }() } —— wg 是拷贝,Add 和 Done 影响的是不同实例
  • 必须传指针:func (wg *WaitGroup) Do() { wg.Add(1); go func() { wg.Done() }() }
  • 更危险的是:多个 goroutine 同时调用 wg.Add(n) 而没加锁 —— Add 本身不是原子操作,可能导致计数错乱

真正难排查的,从来不是 wg.Wait() 卡住,而是那些“看起来执行完了”的 goroutine 其实卡在 select 或 channel 上,还在偷偷吃内存。pprof 查 /debug/pprof/goroutine?debug=2 时,重点盯 chan receive、semacquire、select 这几类堆栈,比盯着 WaitGroup 本身有用得多。

今天关于《Go sync.WaitGroup 内存泄露问题解析》的内容就介绍到这里了,是不是学起来一目了然!想要了解更多关于的内容请关注golang学习网公众号!

Python中if嵌套使用方法详解Python中if嵌套使用方法详解
上一篇
Python中if嵌套使用方法详解
游戏主机光驱不读盘怎么修 清洁光头排查故障方法
下一篇
游戏主机光驱不读盘怎么修 清洁光头排查故障方法
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • PubMedQA数据集详解:生物医学问答基准、功能与应用指南
    PubMedQA
    深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
    329次使用
  • H2O EvalGPT:开源LLM大模型评估与排行榜工具
    H2O EvalGPT
    H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
    386次使用
  • LMArena是什么?伯克利AI模型评估平台使用指南与功能解析
    LMArena
    LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
    379次使用
  • 斯坦福HELM:大语言模型Holistic Evaluation整体评估框架详解
    HELM
    深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
    348次使用
  • MMBench详解:多模态大模型基准测试、功能特点与使用指南
    MMBench
    MMBench是由上海人工智能实验室等机构联合推出的多模态基准测试平台,提供细粒度能力评估、大规模数据集及VLMEvalKit工具。本文详细介绍其核心功能、安装使用方法及应用场景,助力开发者全面评估多模态模型性能。
    172次使用
微信登录更方便
  • 密码登录
  • 注册账号
登录即同意 用户协议 和 隐私政策
返回登录
  • 重置密码