Linux cgroup v2 cpu.max 如何判断 CPU 配额
如果进程运行在 Linux cgroup v2 中,判断 CPU 配额最直接的入口就是目标 cgroup 目录下的 cpu.max。它通常包含两个按微秒计的数字:MAX PERIOD。把前者除以后者,就能得到这个 cgroup 在一个周期内可使用的近似 CPU 数;如果第一个字段是 max,表示这里没有设置带宽上限。需要注意,这个比例是硬配额,不等于机器当前空闲 CPU,也不等于 cpuset 能看到的核数。
cpu.max的格式是MAX PERIOD,单位都是微秒。- 配额比例按
MAX / PERIOD换算;max表示不限额。 cpu.stat里的nr_throttled和throttled_usec能帮助确认是否真的被限流。
先确认 cpu 控制器和目标 cgroup
先找到统一层级的挂载点,再进入承载目标进程的目录。容器环境里常见路径是 /sys/fs/cgroup,但不要把它当成固定答案;systemd、容器运行时或发行版配置都可能让目标 cgroup 位于更深的子目录。
# 只读检查挂载点和当前目录,避免直接改动控制器配置
mountpoint -q /sys/fs/cgroup && echo "cgroup v2 mount exists"
cd /sys/fs/cgroup/app.slice/service-a.scope
printf 'controllers: '; cat cgroup.controllers
printf 'parent enabled: '; cat ../cgroup.subtree_control
printf 'cpu.max: '; cat cpu.max
如果目标目录没有 cpu.max,先别急着写入。通常要检查父级的 cgroup.subtree_control 是否启用了 cpu,以及目标目录是否确实属于 cgroup v2;控制器是沿层级向下分发的,读取错目录会把“没有限制”误判成“文件不存在”。
读取 cpu.max 并换算 CPU 配额
cpu.max 的两个字段分别是每周期允许的 CPU 时间和周期长度,单位都是微秒。例如 200000 100000 表示每 100000 微秒最多消耗 200000 微秒 CPU 时间,换算结果约为 2 个 CPU。25000 100000 则约为 0.25 个 CPU。它描述的是累计带宽上限,多个线程会共享这段额度。

| cpu.max 示例 | 计算 | 含义 |
|---|---|---|
max 100000 | 不限额 | 不设置 CPU 带宽上限 |
200000 100000 | 200000 ÷ 100000 | 约 2 个 CPU |
25000 100000 | 25000 ÷ 100000 | 约 0.25 个 CPU |
这个换算只回答“最多给多少 CPU 时间”。它不能说明进程已经用满,也不能替代负载观测。父级 cgroup 还可能施加更紧的上限,所以排查时要沿父链读取对应的 cpu.max。
结合 cpu.stat 判断是否被限流
当服务变慢时,单看 cpu.max 只能说明配置,不能证明发生了限流。cgroup v2 的 cpu.stat 会给出使用时间和限流统计;在压力持续期间,如果 nr_throttled、throttled_usec 同步增长,才更像是 CPU 带宽耗尽。

| 观察项 | 它回答什么 | 常见误区 |
|---|---|---|
nr_throttled | 发生过多少次限流周期 | 增长不代表每次都长时间停顿 |
throttled_usec | 累计被限流的时间 | 要结合采样间隔看增量 |
cpu.weight | 竞争时的相对权重 | 不是硬配额百分比 |
cpuset.cpus.effective | 实际可用 CPU 集合 | 核数少不一定由 cpu.max 造成 |
# 只读取统计快照;连续采样时请比较两次读数的差值
cat cpu.stat
printf 'effective cpus: '; cat cpuset.cpus.effective
printf 'weight: '; cat cpu.weight
修改配额时保留可回滚的检查路径
调整前先记录原值、父级限制和当前统计。写入时使用两个字段,避免只改周期却忘记原有配额;修改后重新读取,并在相同业务负载下观察限流统计。生产环境更稳妥的做法是先在单个服务 cgroup 上灰度,确认延迟和吞吐变化后再扩大范围。
# 示例:将当前 cgroup 限制为约 1.5 个 CPU;写入前请确认权限和回滚值
old_value=$(cat cpu.max)
printf 'old cpu.max: %s\n' "$old_value"
printf '150000 100000' > cpu.max
printf 'new cpu.max: '; cat cpu.max
# 若需回滚,使用刚才记录的两个原始字段恢复
如果写入失败,优先检查权限、目标是否为非 root cgroup、父级是否已分发 cpu 控制器,以及数值是否满足内核接口要求。不要只把失败归因于“Linux 不支持 cgroup v2”,先确认实际挂载层级。
相关问题
cpu.max 的第一个字段是 max,第二个数字还重要吗?
对当前 CPU 带宽限制来说,max 表示没有上限,但周期字段仍是接口的一部分,读取和写回时应保留完整的两个字段。
cpu.max 和 cpu.weight 有什么区别?
cpu.max 是每周期的硬带宽上限,cpu.weight 是同层级竞争 CPU 时的相对分配权重,不能用权重直接换算出固定 CPU 核数。
为什么 cpu.max 看起来足够,服务仍然变慢?
还要看父级配额、cpuset.cpus.effective、运行队列、IO 等因素;先对比 cpu.stat 的限流计数和限流时间增量,再判断是否是配额问题。
Go io.MultiWriter 如何同时写文件和摘要哈希
- 上一篇
- Go io.MultiWriter 如何同时写文件和摘要哈希
- 下一篇
- LiblibAIstable diffusion在线怎么开始?新手操作步骤
-
- 文章 · linux | 17小时前 |
- Linux cgroup v2 memory.max 如何判断进程被限制
- 216浏览 收藏
-
- 文章 · linux | 18小时前 | Linux · 日志管理 · 运维排障 · 文件描述符 logrotate copytruncate 日志轮替 postrotate
- Linux logrotate rotate 后应用仍写旧文件怎么办
- 285浏览 收藏
-
- 文章 · linux | 19小时前 |
- Linux ulimit -n 调高后仍报 too many open files
- 275浏览 收藏
-
- 文章 · linux | 20小时前 | Linux · 文件系统 · 挂载 · 运维排障 · 工作目录 bind mount Linux mount --bind umount target is busy EBUSY
- Linux mount --bind 解除挂载时为什么要先离开工作目录
- 476浏览 收藏
-
- 文章 · linux | 1天前 | 日志 · Linux · systemd · journalctl ·
- Linux journalctl 如何只看某 systemd 服务本次启动日志
- 268浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 543次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 516次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 500次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 485次学习
-
- H2O EvalGPT
- H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
- 97次使用
-
- OpenCompass
- OpenCompass是上海AI实验室推出的开源大模型评测平台,提供CompassKit、CompassHub和CompassRank三大核心组件,支持LLM及多模态模型的一站式标准化评估与排行榜查询。
- 28次使用
-
- SuperCLUE
- SuperCLUE是权威的中文大语言模型综合评测基准,涵盖语言理解、知识应用、AI Agent智能体及安全性等12项核心能力。通过多轮对话与客观测试,定期发布榜单与技术报告,为模型研发、优化及行业选型提供科学依据。
- 252次使用
-
- C-Eval
- 深入了解C-Eval中文评估套件,涵盖52个学科与4级难度。本文详解其功能特点、Zero-shot/Few-shot使用方法及代码示例,助您全面评测LLM中文理解与泛化能力。
- 180次使用
-
- AI Prompt Library
- 探索AI Prompt Library免费资源库,涵盖营销、写作及多场景AI提示词。兼容ChatGPT、Claude等工具,一键复制优化输出,提升工作效率。
- 111次使用
-
- 详解golang执行Linuxshell命令完整场景下的使用方法
- 2023-01-07 426浏览
-
- go程序部署到linux上运行的实现方法
- 2023-01-02 387浏览
-
- Linux系统下Go语言开发环境搭建
- 2023-01-07 242浏览
-
- 使用golang获取linux上文件的访问/创建/修改时间
- 2022-12-31 238浏览
-
- 在Linux系统中安装Go语言的详细教程
- 2022-12-29 402浏览

