当前位置:首页 > 文章列表 > 数据库 > Redis > Redis如何实现发布订阅的消息去重_结合Bloom Filter与Redis缓存实现幂等性

Redis如何实现发布订阅的消息去重_结合Bloom Filter与Redis缓存实现幂等性

2026-05-04 14:18:42 0浏览 收藏

来到golang学习网的大家,相信都是编程学习爱好者,希望在这里学习数据库相关编程知识。下面本篇文章就来带大家聊聊《Redis如何实现发布订阅的消息去重_结合Bloom Filter与Redis缓存实现幂等性》,介绍一下,希望对大家的知识积累有所帮助,助力实战开发!

Bloom Filter 不能单独用于消息去重,因其存在误判率;必须配合 Redis 的 SET 或 ZSET 做最终校验:SET 适用于简单幂等场景,ZSET 支持滑动窗口限频,典型流程为 Bloom Filter 预筛→Redis 精确判定→三重写入。

Redis如何实现发布订阅的消息去重_结合Bloom Filter与Redis缓存实现幂等性

Redis 原生的 PUB/SUB 不提供消息去重能力,所有订阅者都会无差别收到每一条 PUBLISH 消息。想靠它直接实现幂等消费,必须在业务层补足——Bloom Filter 是轻量级预筛手段,但不能单独用;Redis 缓存(如 SET 或 ZSET)才是落地关键。

为什么 Bloom Filter 不能 standalone 做去重

Bloom Filter 是概率型数据结构,存在误判率(false positive),但不会漏判(false negative)。这意味着:

  • bloom.exists(msg_id) 返回 false → 该 msg_id 绝对没出现过,可安全处理
  • bloom.exists(msg_id) 返回 true → 可能是真重复,也可能是误报,仍需二次确认

所以它只能当“快速拒收门”,不能当“最终判决书”。生产环境必须搭配 Redis 的确定性存储(比如 SET)做最终校验。

用 SET 实现简单可靠的消息 ID 去重

适用于消息体不大、ID 全局唯一、且去重窗口期明确的场景(如订单通知、工单分发)。核心逻辑就是:查 + 写原子判断。

  • 用 SET 存已消费的 msg_id,key 命名为 dedup:channel_name 或带时间戳前缀(如 dedup:order_notify:202604)便于清理
  • 不要先 GET 再 SET —— 这有竞态,改用 SISMEMBER + SADD 组合
  • 若消息量极大、内存敏感,可加 TTL:EXPIRE dedup:channel_name 86400,但注意 TTL 不会自动随 SADD 刷新

Python 示例(使用 redis-py):

def consume_message(redis_cli, channel, msg_id, payload):
    key = f"dedup:{channel}"
    # 原子判断并添加
    if redis_cli.sismember(key, msg_id):
        return False  # 已存在,跳过
    redis_cli.sadd(key, msg_id)
    redis_cli.expire(key, 86400)  # 每次都设 TTL(可选)
    # ✅ 此时才执行业务逻辑
    process(payload)
    return True

用 ZSET 支持滑动窗口去重(防刷/限频)

当需要“1 分钟内同 ID 消息只处理一次”,或消息含时间戳需按有效期裁剪时,ZSET 更合适。它把 msg_id 当 member,时间戳当 score。

  • 插入:ZADD dedup_zset {timestamp} {msg_id}
  • 清理过期项:ZREMRANGEBYSCORE dedup_zset 0 {cutoff_timestamp}
  • 判断是否新消息:ZSCORE dedup_zset {msg_id} 为 nil 才处理

注意:ZSCORE 和 ZADD 非原子,高并发下建议封装成 Lua 脚本执行,避免两次网络往返引入竞态。

Bloom Filter + Redis 的典型协作流程

不是二选一,而是分层过滤:

  • 第一层:本地或 Redis-Mod 的 Bloom Filter(如 BF.EXISTS bloom_key msg_id)快速拦截明显重复
  • 第二层:命中 Bloom Filter 后,再查 SET 或 ZSET 做精确判定
  • 第三层:确认为新消息后,同步写入 Bloom Filter(扩容)、SET(记录)、ZSET(打时间戳)

真正容易被忽略的是 Bloom Filter 的容量预估和扩容成本——一旦初始化 size 固定,后续 BF.RESERVE 无法动态扩容,超容会导致误判率飙升。线上务必根据日均消息量 × 去重周期预估,并留 20% 余量。

终于介绍完啦!小伙伴们,这篇关于《Redis如何实现发布订阅的消息去重_结合Bloom Filter与Redis缓存实现幂等性》的介绍应该让你收获多多了吧!欢迎大家收藏或分享给更多需要学习的朋友吧~golang学习网公众号也会发布数据库相关知识,快来关注吧!

css 表单错误信息怎么自动显示_通过 invalid 伪类联动提示css 表单错误信息怎么自动显示_通过 invalid 伪类联动提示
上一篇
css 表单错误信息怎么自动显示_通过 invalid 伪类联动提示
Seedance 2.0可以定制数字人形象吗 Seedance 2.0私人定制费用
下一篇
Seedance 2.0可以定制数字人形象吗 Seedance 2.0私人定制费用
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • PubMedQA数据集详解:生物医学问答基准、功能与应用指南
    PubMedQA
    深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
    256次使用
  • H2O EvalGPT:开源LLM大模型评估与排行榜工具
    H2O EvalGPT
    H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
    298次使用
  • LMArena是什么?伯克利AI模型评估平台使用指南与功能解析
    LMArena
    LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
    275次使用
  • 斯坦福HELM:大语言模型Holistic Evaluation整体评估框架详解
    HELM
    深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
    253次使用
  • MMBench详解:多模态大模型基准测试、功能特点与使用指南
    MMBench
    MMBench是由上海人工智能实验室等机构联合推出的多模态基准测试平台,提供细粒度能力评估、大规模数据集及VLMEvalKit工具。本文详细介绍其核心功能、安装使用方法及应用场景,助力开发者全面评估多模态模型性能。
    61次使用