Linux pidstat 怎么区分 CPU 忙和 I/O 等待:进程时间、上下文切换与复测方法
线上服务突然变慢时,CPU 使用率高并不等于进程一直在计算。先用 pidstat 对目标 PID 连续采样,再把 CPU 时间、块设备 I/O 延迟和上下文切换放在同一个时间窗口里看,通常能很快分出“算得忙”还是“等资源”。
- CPU 时间持续增长、I/O 延迟接近零,优先检查代码热点和线程竞争。
- CPU 增长很小但
iodelay持续上升,说明进程更像在等块设备或换入。 - 上下文切换只能提供线索,必须配合多次采样和复测,不能凭一个瞬时数字下结论。
先把“变慢”固定成一个采样窗口
排查前先记下进程 PID、发生时间和复现动作。不要只执行一次命令就截图,因为单次输出是累计值或瞬时值混在一起,无法看出变化速度。下面以 PID 1842 为例,先看进程级 CPU:
pidstat -p 1842 -u 1 5
连续五秒的结果里,重点看 %usr、%system、%CPU 和 Command。如果 %CPU 在每个采样点都明显升高,才有理由继续追 CPU;若只有一个点跳高,先扩大采样窗口。

用 CPU 时间增长判断是否真的在计算
pidstat -u 报告的是采样期间的 CPU 使用情况。用户态时间高,通常意味着应用本身在执行计算;内核态时间高,则要继续看系统调用、网络、文件或锁相关路径。这里的结论是“哪一类时间在增长”,不是“某一个字段高就一定是根因”。
pidstat -p 1842 -u -t 1 10
加上 -t 后可以观察线程。若总进程 CPU 不高,但某一线程持续占用,说明平均值把问题稀释了;若许多线程同时出现中等 CPU,又伴随频繁切换,则应把锁竞争和调度压力纳入检查。
内核文档中的 /proc/ 还提供 utime 与 stime 等累计字段。它们适合在需要自建采样器时做差分,不适合拿一个绝对值直接比较两台机器。
把 I/O 等待从 CPU 忙里分出来
对同一 PID 再采样任务切换和块设备 I/O 延迟:
pidstat -p 1842 -w -d 1 10
-w 展示 cswch/s 与 nvcswch/s,-d 展示任务的读写活动和 iodelay。其中 iodelay 是块 I/O 延迟,包含等待同步块 I/O 完成以及换入块 I/O 的时间。CPU 使用率低而 iodelay 连续上升时,更像是等待存储或换入,而不是算力不够。
这个判断仍然需要和设备侧指标对照,例如同一时间查看对应磁盘的队列、吞吐和 await。进程级延迟高而设备并不忙,可能是单个文件、网络文件系统或进程自身的访问模式;不要直接把它写成“磁盘满了”。
上下文切换只能当证据链的一环
主动放弃 CPU 的 voluntary 切换,常见于线程阻塞等待资源;被迫让出 CPU 的 nonvoluntary 切换,则更接近时间片耗尽或调度竞争。通过 pidstat -w 观察两者的变化方向,比单看总切换数更有用。
grep -E 'voluntary_ctxt_switches|nonvoluntary_ctxt_switches' /proc/1842/status
如果 voluntary 切换和 I/O 延迟一起上升,先沿着文件、块设备或锁等待检查;如果 nonvoluntary 切换上升且 CPU 已接近配额,再检查同机竞争进程、CPU 亲和性和容器配额。两种切换都高时,不要急着改优先级,先确认采样期间是否发生了真实流量变化。

改动后怎样做一次可回退复测
一次只改一个变量。例如先恢复并发度,再重复同样的请求数量和采样窗口;不要同时调整 CPU 配额、线程数和磁盘参数,否则即使变快也无法知道是哪项改动起效。
- 保存改动前五到十个采样点,记录
%CPU、iodelay、cswch/s和nvcswch/s。 - 执行一个可重复的业务动作,等待指标回到稳定区间。
- 用相同 PID 采样;若进程已重启,记录新 PID,不要把两段数据拼在一起。
- 若延迟或错误率变差,立即恢复唯一改动,再重复同一复测。
验收看趋势,不看某个漂亮的平均值:CPU 忙的场景应有可解释的 CPU 时间增长;I/O 等待场景应能在 iodelay 或设备侧等待中找到对应证据;修复后至少要在相同负载下重复一次。
常见问题
pidstat 的 %CPU 为什么和 top 不一样?
采样间隔、线程展示方式、CPU 总数归一化和进程是否刚启动都会造成差异。两者不要混用不同时间段的结果,先固定间隔与 PID。
iodelay 高就一定是磁盘坏了吗?
不一定。它表示任务等待块 I/O 或换入的时间,还可能受到文件系统、网络块设备和访问模式影响。应与设备和内核日志一起复核。
上下文切换多是不是一定有锁竞争?
不是。I/O 阻塞、管道、条件变量和调度竞争都可能增加切换。只有在切换变化与锁等待、CPU 饱和或 I/O 延迟同时出现时,才值得继续沿该方向定位。
结语
区分 CPU 忙和 I/O 等待,关键不是背字段名称,而是让同一 PID 在同一采样窗口里留下可比较的变化:先看 CPU 时间,再看 iodelay,最后用上下文切换补充方向。改动后按同样负载复测,结论才站得住。
Go fuzz 测试怎么固定回归样本:种子语料、失败复现与 CI 验收
- 上一篇
- Go fuzz 测试怎么固定回归样本:种子语料、失败复现与 CI 验收
- 下一篇
- IntersectionObserver 怎么避免首屏图片抖动:懒加载、占位尺寸与可见性回收
-
- 文章 · linux | 14小时前 | linux运维 · Linux 日志清理 磁盘空间 journalctl systemd-journald
- journalctl vacuum-size 清理日志的保留策略
- 328浏览 收藏
-
- 文章 · linux | 15小时前 |
- OpenSSH ControlMaster 复用连接的失效原因
- 278浏览 收藏
-
- 文章 · linux | 16小时前 |
- systemd OnCalendar 处理带时区的定时任务
- 453浏览 收藏
-
- 文章 · linux | 20小时前 | 容器 · Linux · Linux mount namespace 挂载传播 bind mount shared mount
- mount namespace 中绑定挂载的传播属性
- 342浏览 收藏
-
- 文章 · linux | 22小时前 |
- ip rule 与多路由表实现策略路由
- 406浏览 收藏
-
- 文章 · linux | 23小时前 |
- nftables 动态集合维护临时封禁地址
- 248浏览 收藏
-
- 文章 · linux | 1天前 | Linux · journalctl Linux日志 journald systemd-journald Storage=persistent
- journald Storage=persistent 保留重启前日志
- 147浏览 收藏
-
- 文章 · linux | 1天前 |
- systemd watchdog 监测服务心跳的配置方法
- 482浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 543次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 516次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 500次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 485次学习
-
- PubMedQA
- 深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
- 416次使用
-
- H2O EvalGPT
- H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
- 496次使用
-
- LMArena
- LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
- 504次使用
-
- HELM
- 深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
- 453次使用
-
- MMBench
- MMBench是由上海人工智能实验室等机构联合推出的多模态基准测试平台,提供细粒度能力评估、大规模数据集及VLMEvalKit工具。本文详细介绍其核心功能、安装使用方法及应用场景,助力开发者全面评估多模态模型性能。
- 281次使用
-
- Go Flight Recorder 实战:线上偶发卡顿,别再只靠日志碰运气
- 2026-06-01 323浏览
-
- Go runtime/trace 任务区域如何标记异步链路:Log、Region 与查看顺序
- 2026-08-27 244浏览
-
- Go 1.25 runtime/pprof Label 控制采样范围:Do、ForLabels 与 goroutine 归因
- 2026-08-27 447浏览
-
- Go runtime/metrics.Float64Histogram 怎么计算 P99:Buckets 与 Counts 的边界
- 2026-08-28 314浏览
-
- Go runtime/trace 如何定位 goroutine 阻塞:trace.NewTask、Logf 与时间线筛选
- 2026-08-28 474浏览

