当前位置:首页 > 文章列表 > 文章 > linux > Linux cgroup v2 cpu.max 如何判断 CPU 配额

Linux cgroup v2 cpu.max 如何判断 CPU 配额

来源:17golang原创 2026-09-12 09:45:24 0浏览 收藏

如果进程运行在 Linux cgroup v2 中,判断 CPU 配额最直接的入口就是目标 cgroup 目录下的 cpu.max。它通常包含两个按微秒计的数字:MAX PERIOD。把前者除以后者,就能得到这个 cgroup 在一个周期内可使用的近似 CPU 数;如果第一个字段是 max,表示这里没有设置带宽上限。需要注意,这个比例是硬配额,不等于机器当前空闲 CPU,也不等于 cpuset 能看到的核数。

要点速览
  • cpu.max 的格式是 MAX PERIOD,单位都是微秒。
  • 配额比例按 MAX / PERIOD 换算;max 表示不限额。
  • cpu.stat 里的 nr_throttledthrottled_usec 能帮助确认是否真的被限流。

先确认 cpu 控制器和目标 cgroup

先找到统一层级的挂载点,再进入承载目标进程的目录。容器环境里常见路径是 /sys/fs/cgroup,但不要把它当成固定答案;systemd、容器运行时或发行版配置都可能让目标 cgroup 位于更深的子目录。

# 只读检查挂载点和当前目录,避免直接改动控制器配置
mountpoint -q /sys/fs/cgroup && echo "cgroup v2 mount exists"
cd /sys/fs/cgroup/app.slice/service-a.scope
printf 'controllers: '; cat cgroup.controllers
printf 'parent enabled: '; cat ../cgroup.subtree_control
printf 'cpu.max: '; cat cpu.max

如果目标目录没有 cpu.max,先别急着写入。通常要检查父级的 cgroup.subtree_control 是否启用了 cpu,以及目标目录是否确实属于 cgroup v2;控制器是沿层级向下分发的,读取错目录会把“没有限制”误判成“文件不存在”。

读取 cpu.max 并换算 CPU 配额

cpu.max 的两个字段分别是每周期允许的 CPU 时间和周期长度,单位都是微秒。例如 200000 100000 表示每 100000 微秒最多消耗 200000 微秒 CPU 时间,换算结果约为 2 个 CPU。25000 100000 则约为 0.25 个 CPU。它描述的是累计带宽上限,多个线程会共享这段额度。

Linux cgroup v2 中 cgroup.controllers、cgroup.subtree_control、cpu.max 与 MAX PERIOD 配额比例的静态关系
图1:从 cgroup v2 层级入口、控制器开关到 cpu.max 字段,理解 CPU 配额比例对应的静态关系。
cpu.max 示例计算含义
max 100000不限额不设置 CPU 带宽上限
200000 100000200000 ÷ 100000约 2 个 CPU
25000 10000025000 ÷ 100000约 0.25 个 CPU

这个换算只回答“最多给多少 CPU 时间”。它不能说明进程已经用满,也不能替代负载观测。父级 cgroup 还可能施加更紧的上限,所以排查时要沿父链读取对应的 cpu.max

结合 cpu.stat 判断是否被限流

当服务变慢时,单看 cpu.max 只能说明配置,不能证明发生了限流。cgroup v2 的 cpu.stat 会给出使用时间和限流统计;在压力持续期间,如果 nr_throttledthrottled_usec 同步增长,才更像是 CPU 带宽耗尽。

Linux cgroup v2 中 cpu.max、cpu.stat 限流统计、cpu.weight 与 cpuset.cpus.effective 的诊断边界
图2:把硬配额、限流统计和其他 CPU 边界分开,避免把权重或 CPU 集合问题误判成 cpu.max 限流。
观察项它回答什么常见误区
nr_throttled发生过多少次限流周期增长不代表每次都长时间停顿
throttled_usec累计被限流的时间要结合采样间隔看增量
cpu.weight竞争时的相对权重不是硬配额百分比
cpuset.cpus.effective实际可用 CPU 集合核数少不一定由 cpu.max 造成
# 只读取统计快照;连续采样时请比较两次读数的差值
cat cpu.stat
printf 'effective cpus: '; cat cpuset.cpus.effective
printf 'weight: '; cat cpu.weight

修改配额时保留可回滚的检查路径

调整前先记录原值、父级限制和当前统计。写入时使用两个字段,避免只改周期却忘记原有配额;修改后重新读取,并在相同业务负载下观察限流统计。生产环境更稳妥的做法是先在单个服务 cgroup 上灰度,确认延迟和吞吐变化后再扩大范围。

# 示例:将当前 cgroup 限制为约 1.5 个 CPU;写入前请确认权限和回滚值
old_value=$(cat cpu.max)
printf 'old cpu.max: %s\n' "$old_value"
printf '150000 100000' > cpu.max
printf 'new cpu.max: '; cat cpu.max
# 若需回滚,使用刚才记录的两个原始字段恢复

如果写入失败,优先检查权限、目标是否为非 root cgroup、父级是否已分发 cpu 控制器,以及数值是否满足内核接口要求。不要只把失败归因于“Linux 不支持 cgroup v2”,先确认实际挂载层级。

相关问题

cpu.max 的第一个字段是 max,第二个数字还重要吗?

对当前 CPU 带宽限制来说,max 表示没有上限,但周期字段仍是接口的一部分,读取和写回时应保留完整的两个字段。

cpu.max 和 cpu.weight 有什么区别?

cpu.max 是每周期的硬带宽上限,cpu.weight 是同层级竞争 CPU 时的相对分配权重,不能用权重直接换算出固定 CPU 核数。

为什么 cpu.max 看起来足够,服务仍然变慢?

还要看父级配额、cpuset.cpus.effective、运行队列、IO 等因素;先对比 cpu.stat 的限流计数和限流时间增量,再判断是否是配额问题。

版本声明
本文转载于:17golang原创 如有侵犯,请联系study_golang@163.com删除
Go io.MultiWriter 如何同时写文件和摘要哈希Go io.MultiWriter 如何同时写文件和摘要哈希
上一篇
Go io.MultiWriter 如何同时写文件和摘要哈希
LiblibAIstable diffusion在线怎么开始?新手操作步骤
下一篇
LiblibAIstable diffusion在线怎么开始?新手操作步骤
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • H2O EvalGPT:开源LLM大模型评估与排行榜工具
    H2O EvalGPT
    H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
    97次使用
  • OpenCompass大模型评测体系详解:功能、使用指南与应用场景
    OpenCompass
    OpenCompass是上海AI实验室推出的开源大模型评测平台,提供CompassKit、CompassHub和CompassRank三大核心组件,支持LLM及多模态模型的一站式标准化评估与排行榜查询。
    28次使用
  • SuperCLUE中文大模型评测基准:功能、能力维度与应用指南
    SuperCLUE
    SuperCLUE是权威的中文大语言模型综合评测基准,涵盖语言理解、知识应用、AI Agent智能体及安全性等12项核心能力。通过多轮对话与客观测试,定期发布榜单与技术报告,为模型研发、优化及行业选型提供科学依据。
    252次使用
  • C-Eval中文评测基准:大语言模型多学科能力评估指南
    C-Eval
    深入了解C-Eval中文评估套件,涵盖52个学科与4级难度。本文详解其功能特点、Zero-shot/Few-shot使用方法及代码示例,助您全面评测LLM中文理解与泛化能力。
    180次使用
  • AI Prompt Library:免费AI提示词库,助力ChatGPT高效创作与营销
    AI Prompt Library
    探索AI Prompt Library免费资源库,涵盖营销、写作及多场景AI提示词。兼容ChatGPT、Claude等工具,一键复制优化输出,提升工作效率。
    111次使用
微信登录更方便
  • 密码登录
  • 注册账号
登录即同意 用户协议隐私政策
返回登录
  • 重置密码