Linux系统编程:进程管理与详解
在Linux系统编程中,进程是操作系统管理的核心概念。当我们启动电脑时,操作系统首先加载到内存中,随后各种应用程序也被加载并通过CPU调度运行,这些运行中的软件即为进程。操作系统通过内核数据结构task_struct来管理和描述进程,task_struct包含了进程的各种属性和状态信息。进程的组织和管理依赖于这种数据结构的有效运用,通常以双链表的形式在Linux中实现。此外,用户可以通过命令如ps -ajx查看系统中运行的所有进程,并通过/proc目录获取进程的详细信息。本文详细探讨了进程的概念、管理方式以及如何通过系统接口如fork创建和管理子进程。
一,进程概念在我们打开电脑之前,我们的文件都是储存在磁盘上的,而当我们打开电脑,第一个要加载的软件就是操作系统本身,然后再次在此基础上,我们使用的各种软件都要先加载到内存中经过CPU的调度才能正常运行,而正在运行的软件可以简单的理解为进程;
值得注意的是,OS上打开的不只有一个进程,而是多个进程,那么OS是如何管理这些进程的呢?
----管理一个对象我们还是遵循以往的套路:先组织,再描述;
二,简单理解进程管理2.1描述进程
我们写好的C/C++程序保存在磁盘上,当我们要使用的时候,OS会将此程序的代码和数据加载到内存中,而这个时候其实就可以叫做是一个进程块了;
但是需要注意的是一个进程可并不是只有代码和数据,还要还要包括对应的属性,还需要管理;所以!本质上进程=内核数据结构(task_struct)+程序的代码和数据;
2.2描述进程对象--task_struct当一个程序的数据和代码加载到内存中时虽然是一个进程块,但是并不完整!OS还要在内核区单独开辟空间还要创建一个描述此进程的对象--task_struct
task_struct是封装了一个进程的属性的结构体,OS通过task_struct来管理进程什么时候给CPU调度,进程的优先级,什么时候进程等待,什么时候阻塞等等各种状态以及对其的各种操作....
OS通过把描述进程的对象task_struct以链表的形式串起来,本质上就是对数据结构的增删查改!
我们来看一下task_struct里面有什么?

我们再强调一遍:一个完整的进程=内核数据结构+代码和数据!
对于OS来讲一个进程的代码和数据并不重要,OS关心的是这个进程的PCB数据结构;因为每一个进程的代码和数据都不一样(学校是不管你平时怎么学习,只会根据你的成绩给予你奖励!);而OS有了PCB数据结构就可以找到进程的代码块和数据;
但是往往加载的进程并不是一个两个,而是很多的进程,所以使用一种合适的数据结构在复杂的场景中更好的调度各个数据就显得尤为重要!
在我们的Linux中task_struct主要是以双链表的形式组织起来,你可能会疑惑,使用一个顺序表来存储不是更好吗?
比如HR在筛选简历的时候,会把优秀建立单独按照优秀程度放在一边,这个过程可能会多次对数据删除和插入,使用线性表就显得十分不友好了!而使用链表只需要通过改变指针,就可以灵活的操作!
当然对进程管理工作取决于你把他放入哪个正在被组织的数据结构中,因为不同的数据结构有不同的特点,所以背后对应的就是不同的算法,而不同的算法对应的就是不同的应用场景。
三,查看进程我们电脑开机,其实就是把OS从外设加载到内存中,因为只有在内存中才能对进程管理!
3.1Windows查看所有进程在Windows上我们可以直接打开任务管理器进行查看正在运行的进程;


我们也能清楚的看到,各个进程的属性(CPU,内存,磁盘...)这不就是我们刚才说的OS对进程的PCB管理吗?
3.2 ps -ajx在Linux上使用指令
代码语言:javascript代码运行次数:0运行复制ps -ajx--查看所有进程

我们可以写一个程序来查看进程;

这里我写了个死循环程序来查看正在运行的code进程 ;

我们会发现有两个code进程,为什么呢?
对于死循环的程序是一直会进行下去的,我们可以使用指令来"杀掉他"!


/proc目录里面存储都是内存级的文件!!在关机时会消失,开机时又会出现,他是对动态运行的所有进程的一个可视化信息!!
其中以数字命名的文件夹就是对应进程的PID,里面包含进程的各种信息;


我们会发现我们可执行程序的父进程是 -bash命令行。
5.2.调用系统接口--getpid我们可以使用系统接口来获取当前进程的PID;
先看一下接口说明:

写一个程序来调用接口查看pid;

这里我每隔一秒打印一行PID和PPID;

结论:每次执行程序,分配的PID都不一样,但是父进程PPID是一样的,其实都是Bash进程;
之后,我重新启动了机器!

发现在重启后,PPID竟然改变了!
结论:Bash(命令行)是机器启动时就创建好的进程,直至关机PID都不会变 !
六,重点:使用系统接口fork创建子进程

fork的功能是创建子进程,如果创建成功给子进程的返回值是0,给父进程的返回值是子进程的PID,如果子进程创建失败,就会返回一个负数
你没有听错,fork有两个返回值!
我们可以写个程序查看下!


我们竟然发现,if和else if竟然在同时运行!这也验证了fork的确有两个返回值,虽然if 和else if 同时执行了,但是却是在不同的进程中;
6.1为什么需要创建子进程?目的:让父子进程执行不同的事情
6.2fork的返回值分析fork为什么给子进程返回0,其实对于子进程来说只是一个标识作用,他可以使用ps 查看自己的PID和父进程的PID;
fork为什么给父进程返回子进程的PID;因为父进程需要对创建的子进程进行管理,因此就需要拿到子进程的PID(标识子进程的唯一性);
6.3fork函数究竟干了什么?fork进程创建了一个子进程->进程=内核数据结构+数据和代码块;
什么是写时拷贝?
6.4为什么fork会有两个返回值?我们现在分析一下fork函数->

我们知道fork函数是拷贝父进程的代码和数据,创建一个新的task_struct,所以这里就有了先后顺序问题;
是先执行完函数返回值之后才创建好了子进程还是在返回值之前就创还能好了子进程呢?
实际上在fork函数内部return id之前,就已经为子进程准备好了一些工作,也就是说在fork结束,return 之前子进程就已经开始执行了,而这时父子进程的fork就会各自执行fork函数的return id语句;
所以!有了两次返回值;
6.5一个变量为什么会有两个值?本质是发生了写实拷贝!
fork给id变量返回的值并不相同,也就是子进程的fork返回值与父进程的不相同,正好与我们上面提到的写实拷贝一致,修改了父进程的数据,就会单独开辟空间储存新数据;
6.6fork语句之前的语句是否还会执行?答案是不会,但是会发生拷贝到子进程中!

按照推测"执行此处"只会打印一次

为什么出现了两次"执行此处"呢?
原因是printf默认是行刷新,也就是遇到回车才会刷新缓冲区,而我们打代码中中并没有回车,数据只是写入了缓冲区中没有刷出来,fork执行完,子进程会把缓冲区的内容也拷贝过去,所以各自在进程结束的时候就会把缓冲区刷新,因此出现了两次"执行此处",并不是子进程执行了printf语句;
下面我们加上\n

父进程会自动把"执行此处"从缓冲区中刷新,而子进程是不会执行fork之前的语句的,所以只打印了一次"执行此处"!;
6.7通过fork理解Bash命令行工作今天关于《Linux系统编程:进程管理与详解》的内容就介绍到这里了,是不是学起来一目了然!想要了解更多关于Linux,进程,pid,Fork,task_struct的内容请关注golang学习网公众号!
Python处理时间序列数据的实用技巧大全
- 上一篇
- Python处理时间序列数据的实用技巧大全
- 下一篇
- Java到底是软件吗?详解运行环境与开发工具
-
- 文章 · linux | 2小时前 | Linux · 运维 · GNU tar 增量归档 listed-incremental exclude-from CACHEDIR.TAG
- tar 增量归档排除缓存目录的参数组合
- 324浏览 收藏
-
- 文章 · linux | 2天前 | Linux · 运维 · 日志排查 · journalctl 启动日志 Boot ID --list-boots systemd日志导出
- journalctl 按启动会话筛选并导出日志
- 369浏览 收藏
-
- 文章 · linux | 2天前 | Linux · Linux防火墙 nftables verdict map 多端口策略
- nftables verdict map 组织多端口策略的规则设计
- 475浏览 收藏
-
- 文章 · linux | 3天前 | 权限控制 · 服务管理 · systemd socket激活 systemd.socket ListenStream Accept
- systemd socket 激活服务的依赖与监听配置
- 229浏览 收藏
-
- 文章 · linux | 3天前 |
- Linux ip rule 怎么按来源地址选择路由表
- 347浏览 收藏
-
- 文章 · linux | 4天前 | Linux · 文件系统 · Linux mount bind mount remount
- Linux bind mount 怎么二次挂载为只读
- 116浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 543次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 516次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 500次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 485次学习
-
- PubMedQA
- 深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
- 290次使用
-
- H2O EvalGPT
- H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
- 343次使用
-
- LMArena
- LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
- 344次使用
-
- HELM
- 深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
- 308次使用
-
- MMBench
- MMBench是由上海人工智能实验室等机构联合推出的多模态基准测试平台,提供细粒度能力评估、大规模数据集及VLMEvalKit工具。本文详细介绍其核心功能、安装使用方法及应用场景,助力开发者全面评估多模态模型性能。
- 130次使用
-
- Linux vmstat 如何分辨内存抖动与磁盘等待:si、so、wa 与复测顺序
- 2026-08-30 501浏览
-
- Linux搭建vsftpdFTP服务器教程
- 2026-04-30 501浏览
-
- Shell脚本安装教程:.sh一键安装指南
- 2026-03-16 501浏览
-
- Linux清空文件内容的几种方法
- 2025-12-01 501浏览
-
- Linux命令行下载文件技巧
- 2025-11-23 501浏览
