当前位置:首页 > 文章列表 > 数据库 > MySQL > MySQL 复制状态中 Retrieved_Gtid_Set 如何辅助定位缺口

MySQL 复制状态中 Retrieved_Gtid_Set 如何辅助定位缺口

来源:17golang原创 2026-09-15 12:38:16 0浏览 收藏

看到副本的 Retrieved_Gtid_Set 比源库的 GTID 集少,不能马上断定“事务丢了”。这个字段表示副本已经收到、并存在或曾存在于 relay log 中的事务;真正写入副本本地 binlog 的进度要看 Executed_Gtid_Set。排查时把两个差集分开算,才能判断问题卡在接收链路还是 SQL 应用线程。

要点速览
  • GTID_SUBTRACT(Retrieved_Gtid_Set, Executed_Gtid_Set) 非空,首先表示已接收但尚未应用的积压。
  • GTID_SUBTRACT(源端 Executed_Gtid_Set, 副本 Retrieved_Gtid_Set) 非空,才说明源端已执行的事务尚未被副本接收。
  • 空差集只能说明当前采样范围内没有发现缺口,还要结合通道、过滤规则、relay log 清理和错误字段复核。

先把 Retrieved 和 Executed 放在同一张状态表里

在副本上执行 SHOW REPLICA STATUS,优先保存同一个通道的完整输出。这个语句是非阻塞的,适合监控采样,但它可能在复制线程变化的瞬间返回稍旧的状态,所以不要只凭一次结果下结论。

-- 读取默认复制通道,重点记录接收、应用和错误字段
SHOW REPLICA STATUS\G;

-- 有多通道时指定通道,避免把不同来源混在一起
SHOW REPLICA STATUS FOR CHANNEL 'orders_channel'\G;

重点字段可以这样理解:

字段它回答什么不能直接推出什么
Retrieved_Gtid_Set副本已经收到哪些 GTID不等于这些事务已经执行
Executed_Gtid_Set副本已经执行并写入本地 binlog 哪些 GTID不等于源端此刻已经没有更新
Auto_Position该通道是否使用 GTID 自动定位不代表复制线程一定健康
Last_IO_Error / Last_SQL_Error接收线程或应用线程最近的错误空值不代表历史上从未出错
MySQL 复制状态示意中并列显示 Retrieved_Gtid_Set、Executed_Gtid_Set 与通道字段
图1:MySQL 复制状态的操作示意图,先把 Retrieved、Executed 和错误字段放到同一份快照中。

先算副本内部差集,判断是否只是应用积压

假设一次采样得到:

-- 以下是脱敏后的示意输出,不代表某台真实服务器
Retrieved_Gtid_Set: 3e11fa47-71ca-11e1-9e33-c80aa9429562:1-120
Executed_Gtid_Set:  3e11fa47-71ca-11e1-9e33-c80aa9429562:1-105

这时先在副本上计算“已收到但未执行”的集合:

-- 计算 relay log 中已收到、但本地尚未执行的 GTID
SELECT GTID_SUBTRACT(
  '3e11fa47-71ca-11e1-9e33-c80aa9429562:1-120',
  '3e11fa47-71ca-11e1-9e33-c80aa9429562:1-105'
) AS received_not_executed;

结果是 ...:106-120,说明接收线程已经把这段事务拿到 relay log,应用线程还没追上。此时优先看 Replica_SQL_RunningReplica_SQL_Running_StateLast_SQL_Error 和并行复制是否出现等待,不要把它当成网络丢包。

再与源端集合比较,定位真正的接收缺口

如果要判断副本是否还没有收到源端已经执行的事务,需要从源库取得同一时刻附近的 Executed_Gtid_Set,再与副本的 Retrieved_Gtid_Set 比较。示例中源端已经到 140,而副本只收到 120:

-- 在源端 SHOW BINARY LOG STATUS 中读取 Executed_Gtid_Set 后代入
-- 差集表示源端已执行、但副本接收集合里暂时没有的 GTID
SELECT GTID_SUBTRACT(
  '3e11fa47-71ca-11e1-9e33-c80aa9429562:1-140',
  '3e11fa47-71ca-11e1-9e33-c80aa9429562:1-120'
) AS source_not_retrieved;

返回 ...:121-140,才应沿着接收链路检查连接、认证、I/O 线程和源端是否仍在产生事务。这个差集和上一节的 106-120 不是同一个问题:前者是“还没收到”,后者是“收到了但还没应用”。

MySQL GTID_SUBTRACT 结果示意区分源端未接收与副本已接收未执行两段集合
图2:结果示意图把两种差集分开显示,避免用 Retrieved_Gtid_Set 代替 Executed_Gtid_Set。

四个边界要在结论里写清楚

  • relay log 被清理:RESET REPLICA、更换源配置或 relay log 恢复过程可能清空 Retrieved 集;清空后的字段不能用来还原完整历史。
  • 多通道:FOR CHANNEL 分开采样。不同来源的 GTID 集混合后,差集很容易被误读。
  • 复制过滤:副本可能按库表过滤事件。差集说明集合差异,不自动说明业务数据一定缺失,要结合过滤规则和目标库范围。
  • 采样时间:源端和副本输出不是原子快照。连续采样两三次,并记录时间、通道和错误字段,比拿两份相隔很久的输出直接相减可靠。

最后可以把检查流程固定成一句话:先看副本内部的 Retrieved - Executed,再看源端的 Executed - 副本 Retrieved,最后用线程状态与错误字段验证。GTID_SUBTRACT() 返回空,只代表给定两组集合没有发现差异,不能替代数据一致性校验。

常见问题

Retrieved_Gtid_Set 为空是不是复制坏了?

不一定。GTID 未启用、通道尚未收到事务、relay log 被清空,都会让它为空,应同时查看 GTID_MODE、线程状态和错误字段。

Retrieved_Gtid_Set 等于 Executed_Gtid_Set 就代表追平了吗?

只代表副本已收到的集合都已执行。若源端在此后产生了新事务,仍需用源端 Executed 集合再比较一次。

为什么不能只看 Seconds_Behind_Source?

它反映的是时间维度的延迟,不能告诉你具体缺哪些 GTID;事务时间戳、并行应用和暂停状态也可能让时间值与集合差异不一致。

差集非空时可以直接跳过事务吗?

不建议。先确认是传输问题、应用错误、过滤规则还是人为暂停,再按复制拓扑和数据恢复方案处理;差集本身不是跳过事务的授权。

版本声明
本文转载于:17golang原创 如有侵犯,请联系study_golang@163.com删除
Go net/http CookieJar 如何隔离不同登录会话Go net/http CookieJar 如何隔离不同登录会话
上一篇
Go net/http CookieJar 如何隔离不同登录会话
Redis Cluster pipeline 遇到 CROSSSLOT 怎么拆分
下一篇
Redis Cluster pipeline 遇到 CROSSSLOT 怎么拆分
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • PubMedQA数据集详解:生物医学问答基准、功能与应用指南
    PubMedQA
    深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
    33次使用
  • H2O EvalGPT:开源LLM大模型评估与排行榜工具
    H2O EvalGPT
    H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
    135次使用
  • LMArena是什么?伯克利AI模型评估平台使用指南与功能解析
    LMArena
    LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
    72次使用
  • 斯坦福HELM:大语言模型Holistic Evaluation整体评估框架详解
    HELM
    深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
    28次使用
  • CMMLU中文大模型评估基准:功能、使用教程与应用场景解析
    CMMLU
    深入了解CMMLU中文评估基准,涵盖67个学科主题,提供数据集下载、Zero-shot/Five-shot评估方法及排行榜,助力优化中文语言模型性能。
    18次使用
微信登录更方便
  • 密码登录
  • 注册账号
登录即同意 用户协议隐私政策
返回登录
  • 重置密码