Linux core_pattern 管道处理程序怎么接收崩溃信息
Linux 的 core_pattern 管道处理程序接收崩溃信息,靠的是两条并行通道:内核把 core dump 的字节流写入处理程序的标准输入,把模板中的 %P、%u、%g、%s、%t、%c、%e 展开后作为命令行参数传入。处理程序不是去某个固定文件名读取 core,而是持续读取 stdin;PID、UID、GID、信号和进程名等定位信息则从 argv 取得。
core_pattern以|开头时,管道后必须紧跟处理程序的绝对路径。- 标准输入是 core 字节流,命令行参数是内核展开的崩溃元数据,两者不要混用。
- 处理程序通常以 root 身份、初始命名空间运行;要访问崩溃进程的
/proc信息,优先传入%P。 core_pipe_limit=0允许并发捕获但不保证等待处理程序,生产环境应按处理能力设置上限。
core_pattern 管道到底把什么交给处理程序
当 /proc/sys/kernel/core_pattern 的第一个字符是竖线时,竖线后面的内容会被解释为用户态程序的命令行。内核不再把转储直接写成当前目录里的 core 文件,而是启动这个程序,并把转储内容接到它的标准输入。
| 通道 | 数据来源 | 典型内容 | 处理方式 |
|---|---|---|---|
| 标准输入 stdin | 内核生成的 core dump | 二进制字节流 | 循环读取并写入受控存储或转发给分析服务 |
| 命令行 argv | core_pattern 模板展开 | PID、UID、GID、信号、时间、大小限制、进程名 | 用于命名、索引和定位,不当作 core 内容读取 |
| /proc/ | 崩溃进程的内核视图 | cwd、comm、status 等信息 | 仅在等待保证与权限条件满足时按需读取 |

最小配置:用绝对路径接收 core 字节流
先用临时配置确认管道形态。下面的参数把 PID、真实 UID/GID、触发信号、时间、进程 core 大小软限制和可执行文件名传给处理程序:
# 临时把崩溃转储交给固定路径的处理程序 sudo sysctl -w 'kernel.core_pattern=|/usr/local/sbin/core-handler %P %u %g %s %t %c %e' # 查看当前模板,确认首字符确实是竖线 cat /proc/sys/kernel/core_pattern # 并发崩溃较多时限制同时运行的管道处理程序数量 sudo sysctl -w kernel.core_pipe_limit=4
处理程序路径必须是绝对路径,并且紧跟在 | 后面。管道程序由内核在初始命名空间启动,不会自动继承崩溃进程的当前工作目录、root 目录或 mount namespace;如果要检查崩溃进程的上下文,应使用传入的 %P 去访问对应的 /proc/。
确认逻辑稳定后再持久化,例如写入 /etc/sysctl.d/50-core-handler.conf,然后由系统的 sysctl 机制加载。不要把可执行文件名直接拼成目录名:%e 是可控的进程标识,应该只用于元数据或经过严格清洗的文件名字段。
处理程序如何同时读取 stdin 和 argv
处理程序的核心逻辑很短:启动时检查参数数量,把 argv 保存为元数据,再从二进制标准输入持续复制到一个预先创建、权限受控的文件。下面是示意实现,重点是读取方式,不代表已经在某台主机执行过。
#!/usr/bin/env python3 import shutil import sys from pathlib import Path # argv[1:] 对应 core_pattern 中的 %P %u %g %s %t %c %e if len(sys.argv)
这里的 core_limit 只是崩溃进程的软限制值,不等于最终一定写出的字节数。管道模式下,内核不会用 RLIMIT_CORE 限制这次传输;真正的存储上限、保留周期和失败重试应由处理程序自己设计。
接收不到信息时先查四个边界
- 模板是否被 systemd 接管。如果
core_pattern类似|/usr/lib/systemd/systemd-coredump %P %u %g %s %t %c %e,崩溃信息先交给 systemd-coredump,而不是自定义程序;此时应使用coredumpctl查询,或明确配置覆盖关系。 - 处理程序是否太慢或不退出。
core_pipe_limit控制可以并行交给用户态处理程序的崩溃数。超过上限时,后续转储会被跳过并写入内核日志;设置为 0 表示并发不设上限,但不保证处理程序还能访问/proc/。 - 权限和安全策略是否允许读取。管道程序通常以 root 和初始命名空间运行,但 SELinux 等 LSM 仍可能阻止它访问崩溃进程的细节。存储目录应由 root 控制,不能把进程名或 PID 直接当作未校验路径。
- 确认输入不是“文件路径”。处理程序若只读取 argv 而没有消费 stdin,会让 core 字节流无人处理;若只读 stdin 而忘记传入
%P,后续很难把文件和崩溃进程对应起来。

常见问题
管道处理程序能从命令行参数拿到 core 文件内容吗?
不能。argv 只有模板展开后的字符串,core 内容在标准输入中,必须从 sys.stdin.buffer 或等价的二进制文件描述符读取。
为什么处理程序必须写绝对路径?
内核按初始命名空间解释处理程序路径,不采用崩溃进程的当前目录和 mount namespace。绝对路径能避免工作目录不同导致的找不到程序问题。
core_pipe_limit 设置越大越好吗?
不是。值越大,处理程序和磁盘可能同时承受更多输入;值为 0 还取消了等待保证。应按处理速度、磁盘容量和允许丢弃的故障量设置,并观察内核日志。
已经配置了自定义处理程序,为什么仍然看不到它的文件?
先检查 core_pattern 是否被 systemd-coredump 覆盖,再检查处理程序是否可执行、存储目录权限是否正确,以及 LSM 是否拦截了访问。不要先把问题归因于 %e 或文件名模板。
Go exec.Cmd.Cancel 与 WaitDelay 分别解决什么问题
- 上一篇
- Go exec.Cmd.Cancel 与 WaitDelay 分别解决什么问题
- 下一篇
- 特效变音魔术师免费吗?授权、广告提示与版本信息怎么核对
-
- 文章 · linux | 3小时前 | Linux io_uring 异步取消 IORING_OP_ASYNC_CANCEL
- Linux io_uring 怎么取消尚未完成的请求
- 395浏览 收藏
-
- 文章 · linux | 5小时前 | Linux · Linux user namespace uid_map
- Linux user namespace 的 uid_map 怎么配置
- 231浏览 收藏
-
- 文章 · linux | 8小时前 | 网络安全 · Linux 防火墙 nftables 动态集合 set timeout gc-interval
- Linux nftables 动态集合怎么设置元素过期时间
- 470浏览 收藏
-
- 文章 · linux | 11小时前 | Linux · 内存管理 · Linux OOM oom_score_adj 进程回收
- Linux oom_score_adj 怎么控制进程被回收优先级
- 306浏览 收藏
-
- 文章 · linux | 15小时前 | 进程管理 · Linux cgroup v2 cgroup.freeze cgroup.events cgroup.procs 进程冻结
- Linux cgroup v2 怎么冻结并恢复一组进程
- 467浏览 收藏
-
- 文章 · linux | 17小时前 | systemd service ReadWritePaths ProtectSystem 文件系统沙箱 Linux服务加固
- systemd ProtectSystem 与 ReadWritePaths 怎么组合
- 485浏览 收藏
-
- 文章 · linux | 20小时前 | Linux · Linux systemd-journald journald.conf RateLimitIntervalSec RateLimitBurst 日志限速
- systemd-journald 日志限速丢弃怎么调整
- 208浏览 收藏
-
- 文章 · linux | 22小时前 |
- journalctl 怎么按服务某次 invocation 筛选日志
- 466浏览 收藏
-
- 文章 · linux | 1天前 | Linux · systemd Restart RestartMode 依赖单元
- systemd RestartMode 怎么减少依赖单元连锁失败
- 239浏览 收藏
-
- 文章 · linux | 1天前 | 定时任务 · Linux · 运维 · Cron OnCalendar Persistent systemd timer systemd-analyze calendar
- systemd timer 替代 cron 的日历表达式配置
- 364浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 543次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 516次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 500次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 485次学习
-
- PubMedQA
- 深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
- 331次使用
-
- H2O EvalGPT
- H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
- 390次使用
-
- LMArena
- LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
- 384次使用
-
- HELM
- 深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
- 352次使用
-
- MMBench
- MMBench是由上海人工智能实验室等机构联合推出的多模态基准测试平台,提供细粒度能力评估、大规模数据集及VLMEvalKit工具。本文详细介绍其核心功能、安装使用方法及应用场景,助力开发者全面评估多模态模型性能。
- 176次使用
-
- Linux vmstat 如何分辨内存抖动与磁盘等待:si、so、wa 与复测顺序
- 2026-08-30 501浏览
-
- Linux搭建vsftpdFTP服务器教程
- 2026-04-30 501浏览
-
- Shell脚本安装教程:.sh一键安装指南
- 2026-03-16 501浏览
-
- Linux清空文件内容的几种方法
- 2025-12-01 501浏览
-
- Linux命令行下载文件技巧
- 2025-11-23 501浏览

