当前位置:首页 > 文章列表 > 数据库 > Redis > Redis AOF 重写期间磁盘空间不足怎么提前发现

Redis AOF 重写期间磁盘空间不足怎么提前发现

来源:17golang原创 2026-09-08 06:08:16 0浏览 收藏

Redis AOF 重写期间突然报磁盘不足,通常不是因为“旧 AOF 文件太大”这么简单。重写会生成新的 base AOF,同时继续接收写入并保存增量内容;切换完成前,旧文件、生成中的新文件和持续增长的增量文件可能同时存在。提前发现的关键,是把 INFO persistence 的状态、AOF 目录实际占用和文件系统可用空间放在同一张容量表里。

要点速览
  • aof_current_size 适合看当前规模,但不能直接代表重写期间的磁盘峰值。
  • Redis 7 的多部分 AOF 要观察 base、increment 和 manifest 所在目录,而不是只看一个文件名。
  • 告警应同时覆盖“即将重写、正在重写、上次重写失败”三种状态,并保留历史重写峰值作为容量预算。

先理解 AOF 重写为什么需要额外磁盘空间

AOF 会记录改变数据集的写操作,重写的目标是用更短的命令集合重建当前数据。Redis 官方文档说明,重写期间父进程继续接收写入,子进程生成新的文件;Redis 7 以后,多部分 AOF 由 base 文件、增量文件和 manifest 共同描述。

因此,重写前至少要回答三个问题:当前 AOF 目录占了多少空间?最近一次重写生成的临时文件峰值是多少?在这段时间里,业务每分钟还会写入多少数据?只拿当前 AOF 大小乘一个固定倍数,容易在写入高峰或备份并行时失真。

Redis AOF 重写中 appendonlydir、旧 base AOF、增量 AOF、新 base AOF 与 manifest 的静态空间关系
图1:AOF 重写期间旧文件、生成中的新 base AOF 和持续写入的增量文件会形成并存的存储边界,因此当前文件大小不能直接当作临时峰值。

用 INFO persistence 观察重写状态

先在业务低峰和高峰各采集一次持久化信息,建立自己的基线。下面的命令只读取状态,不会触发重写:

# 只查看 Redis 持久化相关字段,便于接入监控采集
redis-cli INFO persistence | awk -F: '/^(aof_|rdb_)/ {print}'

# 手动关注重写是否进行、是否排队、上次结果是否成功
redis-cli INFO persistence | grep -E 'aof_(current_size|base_size|rewrite_in_progress|pending_rewrite|last_bgrewrite_status)'

重点字段可以这样读:

字段用途容量判断
aof_current_size当前 AOF 文件规模作为当前基线,不等于重写临时峰值
aof_base_size最近启动或重写后的基线规模与 current size 对比增长趋势
aof_rewrite_in_progress当前是否正在重写为 1 时提高磁盘余量告警级别
aof_pending_rewrite是否等待 RDB 完成后排队重写说明空间检查不能再拖
aof_last_bgrewrite_status上次重写是否成功失败时先查空间和日志,再决定是否处理

aof_last_cow_size 也值得记录,但它描述的是上次重写期间的写时复制内存,不是磁盘临时文件大小。它可以帮助判断 fork 压力,不能直接拿来当磁盘预算。

把 AOF 目录占用和文件系统余量接起来

Redis 文档建议用 INFO persistence 检查重写状态;容量告警还必须落到 AOF 目录所在的文件系统。Redis 7 以后,AOF 文件通常位于 appenddirname 指定的目录,实际路径以实例配置为准。可以把下面的路径替换成真实目录:

# 统计多部分 AOF 目录的实际占用,单位为 KiB
du -sk /var/lib/redis/appendonlydir

# 查看同一文件系统的可用空间,避免只看整个主机的总剩余空间
df -Pk /var/lib/redis | awk 'NR==2 {print "available_kb=" $4, "used_percent=" $5}'

容量预算建议使用历史观测值,而不是写死一个“剩余 20% 就安全”的数字。可把每次重写期间目录占用的最大值记为 rewrite_peak,再加上监控窗口内的写入增长、备份副本和运维缓冲;当文件系统可用空间低于这组预算时,先扩容或迁移目录,再允许下一次重写。

Redis INFO persistence 指标、du 目录占用、df 文件系统余量与 AOF 容量告警边界的关系
图2:容量告警应同时读取 Redis 重写状态、AOF 目录占用和宿主文件系统余量,不能只盯一个 INFO 字段。

设置告警、处理失败并保留恢复余地

生产上可以把信号拆成三档:预警是可用空间低于历史重写预算;进行中aof_rewrite_in_progress=1 且余量继续下降;失败aof_last_bgrewrite_status 不为成功或日志出现写入失败。进行中不要反复手动执行 BGREWRITEAOF,失败后也不要只靠重试掩盖根因。

如果磁盘在写入 AOF 时已经满,尾部可能出现截断。Redis 文档说明,较新的 Redis 默认可以丢弃最后一个不完整命令继续加载,但这不等于可以忽略数据损失;处理前应先保留原文件副本,再按版本和运维预案检查。真正稳妥的顺序是:停止继续制造磁盘压力,保存日志和 AOF 文件状态,补足空间,确认重写状态恢复,再安排一次可观察的重写。

相关问题

只看 aof_current_size 能判断磁盘够不够吗?

不能。它是当前 AOF 规模,重写期间还要考虑新 base、增量写入、临时 manifest 和同目录其他文件,最好叠加历史峰值与增长速率。

aof_rewrite_in_progress 为 0 就代表没有风险吗?

不代表。还要看是否有 aof_pending_rewrite、上次重写结果以及文件系统余量;排队重写可能在稍后启动。

appendfsync everysec 能解决磁盘不足吗?

不能。appendfsync 影响持久化同步频率和数据丢失窗口,不会消除 AOF 文件增长或重写期间的临时空间需求。

重写失败后应该马上再次 BGREWRITEAOF 吗?

不应盲目重试。先确认目录和文件系统余量、上次错误状态以及是否仍有 RDB 操作,再修复容量或并发压力。

版本声明
本文转载于:17golang原创 如有侵犯,请联系study_golang@163.com删除
Go 泛型函数调用时类型参数推断失败怎么办Go 泛型函数调用时类型参数推断失败怎么办
上一篇
Go 泛型函数调用时类型参数推断失败怎么办
Go 解压 ZIP 时怎么区分目录条目和空文件
下一篇
Go 解压 ZIP 时怎么区分目录条目和空文件
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • H2O EvalGPT:开源LLM大模型评估与排行榜工具
    H2O EvalGPT
    H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
    19次使用
  • SuperCLUE中文大模型评测基准:功能、能力维度与应用指南
    SuperCLUE
    SuperCLUE是权威的中文大语言模型综合评测基准,涵盖语言理解、知识应用、AI Agent智能体及安全性等12项核心能力。通过多轮对话与客观测试,定期发布榜单与技术报告,为模型研发、优化及行业选型提供科学依据。
    175次使用
  • C-Eval中文评测基准:大语言模型多学科能力评估指南
    C-Eval
    深入了解C-Eval中文评估套件,涵盖52个学科与4级难度。本文详解其功能特点、Zero-shot/Few-shot使用方法及代码示例,助您全面评测LLM中文理解与泛化能力。
    110次使用
  • AI Prompt Library:免费AI提示词库,助力ChatGPT高效创作与营销
    AI Prompt Library
    探索AI Prompt Library免费资源库,涵盖营销、写作及多场景AI提示词。兼容ChatGPT、Claude等工具,一键复制优化输出,提升工作效率。
    38次使用
  • Generrated:DALL·E 2/3 AI绘画提示词灵感库与图像对比平台
    Generrated
    Generrated汇集9300+张DALL·E生成图像及对应提示词,支持查看完整图集、对比DALL·E 2与3版本差异,是AI绘图新手学习Prompt设计与获取创作灵感的实用工具。
    17次使用
微信登录更方便
  • 密码登录
  • 注册账号
登录即同意 用户协议隐私政策
返回登录
  • 重置密码