当前位置:首页 > 文章列表 > 文章 > linux > Linux find -xdev 排查目录为何越过挂载点:du 与 bind mount 的边界

Linux find -xdev 排查目录为何越过挂载点:du 与 bind mount 的边界

来源:17golang原创 2026-08-20 14:00:20 0浏览 收藏

服务器上的目录明明只有几十 GB,du -sh /data 却比预期大很多,或者扫描目录时突然把备份盘、容器卷一起列出来,常见原因不是 du 算错,而是目录树中间跨过了挂载点。排查时先用 findmnt 看边界,再用 find -xdev 或 -mount 限制扫描范围,最后用 df 对照底层文件系统。

要点速览
  • du 统计目录树里的文件,df 统计文件系统已用块,两者口径本来就不同。
  • find -xdev 与 -mount 都能阻止扫描跨到其他文件系统,但先用 findmnt -T 确认挂载边界更稳妥。
  • bind mount 可能让同一批文件从另一个路径再次可见,排查时要记录源路径和目标路径。
  • 清理前先判断空间属于目录文件、已删除但仍打开的文件,还是另一个挂载点;不要只凭 du 的一行结果删除数据。
排查目录大小异常飘出预期值,核心是先对齐你要统计的路径所属文件系统边界,用 find -xdev 锁死当前设备扫描范围,就能避免把跨挂载的其他盘内容误算进来。

先分清 du、df 和挂载点在回答什么

du 从目录向下累加文件大小,适合回答“这个目录树里有哪些大文件”;df 读取文件系统统计,适合回答“这个挂载的磁盘还剩多少”。当目录包含挂载点时,两个数字不一致是正常现象。

命令统计范围适合判断
du -sh /data递归目录树目录下文件的累计大小
df -h /data路径所在文件系统文件系统已用与可用空间
findmnt -T /data路径对应挂载层设备、文件系统类型和挂载参数
find -xdev /data只在当前设备扫描排除子挂载点后的文件清单
findmnt -T /data
df -hT /data
du -xsh /data

先记下 SOURCE、FSTYPE 和 TARGET。如果 /data/cache 是单独挂载的文件系统,那么不带限制的 du 会继续向下走;du -x 则只统计与起点同一文件系统的内容。

Linux findmnt、df 与 du 对照目录树和挂载点边界

用 find -xdev 固定目录扫描边界

需要列出大文件时,可以把 -xdev 放在路径后面,配合大小过滤和空格安全的打印方式。GNU find 也支持同义选项 -mount,团队脚本最好统一一种写法。

find /data -xdev -type f -size +1G -printf '%s %p\n' \
  | sort -nr | head -20

# 兼容习惯写法
find /data -mount -type f -mtime +30 -print

如果只是看一级目录,du -xhd1 /data 更直观;如果要交给后续脚本处理,使用 -print0 和空字符分隔,避免文件名中有空格或换行时误拆分。

注意 -xdev 按设备边界工作。某些 bind mount 与源目录共享同一设备号,不能简单把“同一设备”理解成“同一路径”;这正是需要额外核对挂载表的地方。

Linux find -xdev 扫描大文件时遇到挂载点和 bind mount 的分支判断

bind mount 重复出现时怎么核对

bind mount 会把已有目录从另一个路径暴露出来。例如 /srv/app/cache 被绑定到 /var/lib/app-cache 后,两个路径都可能被扫描工具看到。先列出挂载关系,再决定从哪个入口统计。

findmnt -R /srv/app
findmnt -T /srv/app/cache
mountinfo=$(awk '$5=="/srv/app/cache" {print}' /proc/self/mountinfo)
printf '%s\n' "$mountinfo"

若目标是计算真实数据量,选择一个不会重复进入的入口,并在记录里写明 bind mount 的源和目标。若目标是验证某个容器或服务可见的空间,则应从它实际看到的路径执行 df 和 du,不要拿宿主机的目录结果代替。

清理之前做一次反向验证

  • du -xsh 很小、df 却很满:检查已删除但仍被进程打开的文件,以及其他入口下的挂载点。
  • du 很大、df 也同步变大:先按目录和修改时间列清单,确认业务是否仍在使用。
  • 只有容器里异常、宿主机正常:从容器的挂载视图执行 findmnt -R,确认 bind mount 和读写层。

建议把命令输出保存到工单或值班记录中,再进行删除、截断或卸载。文件系统边界没核清时,rm -rf 的风险远高于一次多花几分钟的核对。

常见问题

find -xdev 和 find -mount 有什么区别?

在 GNU find 中它们都是限制跨文件系统的选项,作用基本等价;脚本中保持一种写法并在目标发行版上实测即可。

为什么 du 和 df 的结果总是对不上?

du 统计目录可见文件,df 统计整个文件系统块,还可能受挂载点和已删除打开文件影响;两者用于不同问题,不应要求完全相等。

bind mount 会让文件被计算两次吗?

从两个路径入口递归扫描时可能重复看到同一内容。应先用 findmnt 找出源、目标关系,再固定单一统计入口。

清理大目录前最少要保存哪些信息?

至少保存 findmnt、df -hT、受限 du 和待删除文件清单,并确认服务、容器和备份任务没有依赖这些路径。

目录空间异常时,先确认“统计对象”再确认“清理对象”。findmnt 定边界,find -xdev 控范围,du 找文件,df 看文件系统,四个角度对齐后再动数据。

版本声明
本文转载于:17golang原创 如有侵犯,请联系study_golang@163.com删除
Redis SORT_RO 怎么在只读副本排序:LIMIT、GET 与 ALPHA 边界Redis SORT_RO 怎么在只读副本排序:LIMIT、GET 与 ALPHA 边界
上一篇
Redis SORT_RO 怎么在只读副本排序:LIMIT、GET 与 ALPHA 边界
ResizeObserver 无限循环怎么排查:用 requestAnimationFrame 合并布局写入
下一篇
ResizeObserver 无限循环怎么排查:用 requestAnimationFrame 合并布局写入
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • PubMedQA数据集详解:生物医学问答基准、功能与应用指南
    PubMedQA
    深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
    336次使用
  • H2O EvalGPT:开源LLM大模型评估与排行榜工具
    H2O EvalGPT
    H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
    393次使用
  • LMArena是什么?伯克利AI模型评估平台使用指南与功能解析
    LMArena
    LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
    388次使用
  • 斯坦福HELM:大语言模型Holistic Evaluation整体评估框架详解
    HELM
    深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
    353次使用
  • MMBench详解:多模态大模型基准测试、功能特点与使用指南
    MMBench
    MMBench是由上海人工智能实验室等机构联合推出的多模态基准测试平台,提供细粒度能力评估、大规模数据集及VLMEvalKit工具。本文详细介绍其核心功能、安装使用方法及应用场景,助力开发者全面评估多模态模型性能。
    176次使用
微信登录更方便
  • 密码登录
  • 注册账号
登录即同意 用户协议 和 隐私政策
返回登录
  • 重置密码