Python pathlib.Path.glob 递归匹配隐藏目录怎么处理
用 pathlib.Path.glob() 递归查找文件时,隐藏目录是否能匹配,关键不在于额外打开一个“显示隐藏文件”开关,而在于 pathlib 和 glob 模块的规则不同:Path.glob("**/*.py") 会进入普通目录和点号开头的隐藏目录。若目标是排除 .git、缓存或构建目录,就要在结果中检查路径组件,或者在遍历目录时提前裁剪。
官方文档:https://docs.python.org/3/library/pathlib.html
- pathlib 不把点号开头的路径当作特殊项,
**会递归匹配到隐藏目录。 - 只想包含隐藏目录时直接使用
glob或rglob;想排除时检查相对路径的每个组件。 - 目录树很大时,用
Path.walk()从dirnames中移除隐藏目录,减少后续扫描。
Path.glob 为什么会匹配到隐藏目录
Path.glob() 接收相对模式,** 表示任意层级的文件或目录组件。pathlib 的点号文件名没有特殊排除语义,所以 .cache、.git 这样的目录和 src 一样会参与匹配。Path.rglob("*.py") 可以理解为在模式前加上 **/。

** 递归会进入普通目录和隐藏目录;点号开头的路径不会被自动排除。因此下面的代码会把隐藏目录中的 Python 文件也纳入结果:
from pathlib import Path
root = Path("project")
# ** 会递归进入每一层目录,pathlib 不会自动排除点号目录
matches = list(root.glob("**/*.py"))
# glob 返回顺序不固定;需要稳定输出时显式排序
for path in sorted(matches):
print(path)
如果你只是希望“递归查找所有 Python 文件”,这已经是正确写法;不要为了匹配隐藏目录再拼接一个 .* 模式。只有需要排除隐藏目录时,才需要增加过滤逻辑。
包含隐藏目录和排除隐藏目录,写法不是一回事
包含隐藏目录的规则很简单:使用 root.glob("**/*.py") 或 root.rglob("*.py")。排除时不能只判断文件名,因为普通目录下的文件可能位于隐藏目录的更深层;应该检查相对于根目录的每一个路径组件。
from pathlib import Path
def is_hidden_component(name: str) -> bool:
# 单独处理当前目录标记,避免把空名称当成隐藏项
return bool(name) and name.startswith(".") and name not in {".", ".."}
root = Path("project")
visible_python_files = []
for path in root.rglob("*.py"):
relative_parts = path.relative_to(root).parts
# 任意一层是隐藏目录或隐藏文件,就不纳入公开文件集
if any(is_hidden_component(part) for part in relative_parts):
continue
visible_python_files.append(path)
for path in sorted(visible_python_files):
print(path)
| 目标 | 建议写法 | 注意点 |
|---|---|---|
| 包含隐藏目录中的文件 | root.rglob("*.py") | 点号路径不会自动排除 |
| 排除所有隐藏路径 | 遍历结果并检查每个 relative_to(root).parts | 不要只检查最后一个文件名 |
| 只找隐藏目录中的文件 | 保留包含点号组件的结果 | 明确是否把隐藏文件本身也算入 |
要排除隐藏目录时,先过滤还是先裁剪
目录规模不大时,“先 glob、后过滤”最直观,也便于复用 rglob 的匹配模式。若目录树很深,仍然遍历了 .git 或缓存目录,就会产生不必要的扫描。Python 3.12 及更高版本可以考虑 Path.walk(),在继续进入子目录前修改 dirnames。

Path.walk() 的目录列表中裁剪隐藏目录。from pathlib import Path
root = Path("project")
for directory, dirnames, filenames in root.walk():
# top_down=True 时修改 dirnames,就能阻止后续进入隐藏目录
dirnames[:] = [name for name in dirnames if not name.startswith(".")]
for filename in filenames:
if filename.endswith(".py") and not filename.startswith("."):
print(directory / filename)
这个方案的重点是“裁剪目录”,而不是把隐藏目录访问后再丢弃。它适合明确不需要扫描隐藏目录的项目文件、源码或导入目录。若还要跟随符号链接、处理权限错误或跨 Python 版本运行,应把这些条件写进脚本说明,不能仅凭输出为空就判断目录不存在。
最后检查排序、符号链接和权限边界
glob 和 rglob 的结果没有保证顺序,生成清单、比较差异或写入缓存前应使用 sorted()。在递归模式下,pathlib 默认不会沿着符号链接继续扩展 **;如果业务确实需要跟随链接,要评估循环和重复文件的风险,再显式使用支持该参数的 Python 版本。
当前官方文档还说明,扫描目录时产生的 OSError 会被抑制,其中包括访问无权限目录时的 PermissionError。这意味着“没有匹配结果”不一定等于“没有文件”,生产脚本可以在关键目录上额外调用 stat() 或在遍历方案中设置错误处理,保留可诊断信息。
常见问题
Path.glob("**/*.py") 会自动跳过 .git 吗?
不会。pathlib 中点号开头的路径不是特殊排除项;要跳过 .git,应按路径组件过滤,或在 Path.walk() 中裁剪目录。
glob() 和 rglob() 怎么选?
需要表达完整相对模式时用 glob();只想从当前根目录递归匹配某个文件模式时,rglob("*.py") 更短。两者都要考虑无序结果和符号链接边界。
为什么代码在一个目录有结果,换个目录却为空?
可能是根路径不同、权限导致扫描错误被抑制,也可能是模式只匹配文件而实际目标是目录。先打印根路径和相对组件,再对关键目录执行显式状态检查。
Java Stream groupingBy 后如何按自定义比较器输出分组
- 上一篇
- Java Stream groupingBy 后如何按自定义比较器输出分组
- 下一篇
- Go io.LimitReader 包装请求体后为什么拿不到完整错误信息
-
- 文章 · python教程 | 2小时前 | 正则表达式 · python · finditer · Python 正则表达式 re.finditer 重叠匹配
- Python re.finditer 处理重叠匹配时为什么会漏结果
- 193浏览 收藏
-
- 文章 · python教程 | 4小时前 | 默认值 · Python教程 · 数据类 · 对象初始化 · Python 可变默认值 default_factory dataclasses dataclasses.field
- Python dataclasses.field 默认工厂为什么不能直接写成列表
- 495浏览 收藏
-
- 文章 · python教程 | 4小时前 | 打包 · python · C扩展 · free-threading · wheel Python 3.15 abi3t cp315t
- Python 3.15 的 abi3t 与 cp315t wheel 如何选择
- 331浏览 收藏
-
- 文章 · python教程 | 10小时前 | python · typing · Annotated · 运行时反射 typing.Annotated Python类型注解
- Python typing.Annotated 的元数据怎么在运行时读取
- 347浏览 收藏
-
- 文章 · python教程 | 18小时前 | 并发 · 日志 · python · Python logging QueueHandler QueueListener
- Python logging QueueListener 停止时怎么保证剩余日志写完
- 496浏览 收藏
-
- 文章 · python教程 | 1天前 |
- Python asyncio.wait_for 超时后如何保留任务清理机会
- 469浏览 收藏
-
- 文章 · python教程 | 1天前 |
- Python asyncio.timeout 和 wait_for 的超时范围怎么选择
- 386浏览 收藏
-
- 文章 · python教程 | 1天前 | Windows · 跨平台 · Python教程 · 文件系统 · Python Python 3.15 os.path.isreserved Windows 保留路径 ntpath
- Python 3.15 os.path.isreserved 怎么判断 Windows 保留路径
- 343浏览 收藏
-
- 文章 · python教程 | 1天前 | Python教程 · pathlib · 文件系统 · 版本兼容 · Python 目录权限 Python 3.15 pathlib.Path.mkdir parent_mode
- Python pathlib.Path.mkdir 的 parent_mode 怎么影响中间目录
- 243浏览 收藏
-
- 文章 · python教程 | 1天前 | 并发 · python · C API · Python C扩展 free-threaded Py_GIL_DISABLED
- Python free-threaded 构建中 C 扩展如何声明线程安全状态
- 260浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 543次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 516次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 500次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 485次学习
-
- H2O EvalGPT
- H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
- 62次使用
-
- SuperCLUE
- SuperCLUE是权威的中文大语言模型综合评测基准,涵盖语言理解、知识应用、AI Agent智能体及安全性等12项核心能力。通过多轮对话与客观测试,定期发布榜单与技术报告,为模型研发、优化及行业选型提供科学依据。
- 222次使用
-
- C-Eval
- 深入了解C-Eval中文评估套件,涵盖52个学科与4级难度。本文详解其功能特点、Zero-shot/Few-shot使用方法及代码示例,助您全面评测LLM中文理解与泛化能力。
- 147次使用
-
- AI Prompt Library
- 探索AI Prompt Library免费资源库,涵盖营销、写作及多场景AI提示词。兼容ChatGPT、Claude等工具,一键复制优化输出,提升工作效率。
- 79次使用
-
- Generrated
- Generrated汇集9300+张DALL·E生成图像及对应提示词,支持查看完整图集、对比DALL·E 2与3版本差异,是AI绘图新手学习Prompt设计与获取创作灵感的实用工具。
- 57次使用
-
- go格式“占位符”输入输出 类似python的input
- 2023-01-19 346浏览
-
- Golang如何调用Python代码详解
- 2023-01-07 235浏览
-
- HTTP 的 response 中的响应体和头部是分开发送的吗?
- 2023-01-28 387浏览
-
- B站等视频网站的弹幕用的是 websocket 还是轮询?
- 2023-02-16 447浏览
-
- Linux 下有什么命令行工具以时序显示 CPU 占用率?
- 2023-01-13 360浏览

