Google Pub/Sub 的 RetryPolicy 中配置的指数退避如何工作?
本篇文章主要是结合我之前面试的各种经历和实战开发中遇到的问题解决经验整理的,希望这篇《Google Pub/Sub 的 RetryPolicy 中配置的指数退避如何工作?》对你有很大帮助!欢迎收藏,分享给更多的需要的朋友学习~
cloud.google.com/go/pubsub 库最近发布(v1.5.0,参见 https://github.com/googleapis/google-cloud-go/releases/tag/pubsub%2fv1.5.0)支持新的 retrypolicy 服务器端功能。目前的文档 (https://godoc.org/cloud.google.com/go/pubsub#retrypolicy) 内容为
我读过维基百科文章,虽然它描述了离散时间的指数退避,但我不明白该文章与 minimumbackoff 和 maximumbackoff 参数有何具体关系。有关这方面的指导,我参考了 github.com/cenkalti/backoff 的文档,https://pkg.go.dev/github.com/cenkalti/backoff/v4?tab=doc#exponentialbackoff。该库将 exponentialbackoff 定义为
type exponentialbackoff struct {
initialinterval time.duration
randomizationfactor float64
multiplier float64
maxinterval time.duration
// after maxelapsedtime the exponentialbackoff returns stop.
// it never stops if maxelapsedtime == 0.
maxelapsedtime time.duration
stop time.duration
clock clock
// contains filtered or unexported fields
}
其中每个随机间隔的计算方式为
randomized interval =
retryinterval * (random value in range [1 - randomizationfactor, 1 + randomizationfactor])
其中 retryinterval 是当前的重试间隔,据我了解,它从 initialinterval 的值开始,并以 maxinterval 为上限。
我是否正确理解 minimumbackoff 和 maximumbackoff 对应于 github.com/cenkalti/backoff 中的 initialinterval 和 maxinterval ?也就是说,minimumbackoff 是初始等待周期,maximumbackoff 是重试之间允许的最大时间?
为了测试我的理论,我编写了以下简化程序:
package main
import (
"context"
"flag"
"fmt"
"log"
"os"
"time"
"cloud.google.com/go/pubsub"
"google.golang.org/grpc/codes"
"google.golang.org/grpc/status"
)
var (
projectid string
minimumbackoff, maximumbackoff time.duration
)
const (
topicname = "test-topic"
subname = "test-subscription"
defaultminimumbackoff = 10 * time.second
defaultmaximumbackoff = 10 * time.minute
)
func main() {
flag.stringvar(&projectid, "projectid", "my-project", "google project id")
flag.durationvar(&minimumbackoff, "minimumbackoff", 5*time.second, "minimum backoff")
flag.durationvar(&maximumbackoff, "maximumbackoff", 60*time.second, "maximum backoff")
flag.parse()
log.printf("running with minumum backoff %v and maximum backoff %v...", minimumbackoff, maximumbackoff)
retrypolicy := &pubsub.retrypolicy{minimumbackoff: minimumbackoff, maximumbackoff: maximumbackoff}
client, err := pubsub.newclient(context.background(), projectid)
if err != nil {
log.fatalf("newclient: %v", err)
}
topic, err := client.createtopic(context.background(), topicname)
if err != nil {
log.fatalf("createtopic: %v", err)
}
log.printf("created topic %q", topicname)
defer func() {
topic.stop()
if err := topic.delete(context.background()); err != nil {
log.fatalf("delete topic: %v", err)
}
log.printf("deleted topic %s", topicname)
}()
sub, err := client.createsubscription(context.background(), subname, pubsub.subscriptionconfig{
topic: topic,
retrypolicy: retrypolicy,
})
if err != nil {
log.fatalf("createsubscription: %v", err)
}
log.printf("created subscription %q", subname)
defer func() {
if err := sub.delete(context.background()); err != nil {
log.fatalf("delete subscription: %v", err)
}
log.printf("deleted subscription %q", subname)
}()
go func() {
sub.receive(context.background(), func(ctx context.context, msg *pubsub.message) {
log.printf("nacking message: %s", msg.data)
msg.nack()
})
}()
topic.publish(context.background(), &pubsub.message{data: []byte("hello, world!")})
log.println("published message")
time.sleep(60 * time.second)
}
如果我使用分别为 5 秒和 60 秒的默认 minimumbackoff 和 maximumbackoff 运行它,我会得到以下输出:
> go run main.go 2020/07/29 18:49:32 running with minumum backoff 5s and maximum backoff 1m0s... 2020/07/29 18:49:33 created topic "test-topic" 2020/07/29 18:49:34 created subscription "test-subscription" 2020/07/29 18:49:34 published message 2020/07/29 18:49:36 nacking message: hello, world! 2020/07/29 18:49:45 nacking message: hello, world! 2020/07/29 18:49:56 nacking message: hello, world! 2020/07/29 18:50:06 nacking message: hello, world! 2020/07/29 18:50:17 nacking message: hello, world! 2020/07/29 18:50:30 nacking message: hello, world! 2020/07/29 18:50:35 deleted subscription "test-subscription" 2020/07/29 18:50:35 deleted topic test-topic
而如果我分别使用 1 秒和 2 秒的 minimumbackoff 和 maximumbackoff 运行它,我得到
> go run main.go --minimumBackoff=1s --maximumBackoff=2s 2020/07/29 18:50:42 Running with minumum backoff 1s and maximum backoff 2s... 2020/07/29 18:51:11 Created topic "test-topic" 2020/07/29 18:51:12 Created subscription "test-subscription" 2020/07/29 18:51:12 Published message 2020/07/29 18:51:15 Nacking message: Hello, world! 2020/07/29 18:51:18 Nacking message: Hello, world! 2020/07/29 18:51:21 Nacking message: Hello, world! 2020/07/29 18:51:25 Nacking message: Hello, world! 2020/07/29 18:51:28 Nacking message: Hello, world! 2020/07/29 18:51:31 Nacking message: Hello, world! 2020/07/29 18:51:35 Nacking message: Hello, world! 2020/07/29 18:51:38 Nacking message: Hello, world! 2020/07/29 18:51:40 Nacking message: Hello, world! 2020/07/29 18:51:44 Nacking message: Hello, world! 2020/07/29 18:51:47 Nacking message: Hello, world! 2020/07/29 18:51:50 Nacking message: Hello, world! 2020/07/29 18:51:52 Nacking message: Hello, world! 2020/07/29 18:51:54 Nacking message: Hello, world! 2020/07/29 18:51:57 Nacking message: Hello, world! 2020/07/29 18:52:00 Nacking message: Hello, world! 2020/07/29 18:52:03 Nacking message: Hello, world! 2020/07/29 18:52:06 Nacking message: Hello, world! 2020/07/29 18:52:09 Nacking message: Hello, world! 2020/07/29 18:52:12 Nacking message: Hello, world! 2020/07/29 18:52:13 Deleted subscription "test-subscription" 2020/07/29 18:52:13 Deleted topic test-topic
似乎在后一个示例中,nack 之间的时间非常一致~3 秒,这大概代表了在 2 秒的 maximumbackoff 中做到这一点的“最大努力”?我仍然不清楚的是是否有随机化,是否有乘数(从第一个例子来看,重试之间的时间似乎每次都没有两倍长),以及是否有等价的maxelapsedtime 的时间,超过该时间就不再重试?
解决方案
最小退避和最大退避的重试策略字段类似于上面示例中的InitialInterval 和MaxInterval。 Cloud Pub/Sub 使用与您提到的类似的公式来计算指数延迟。这也包括随机化。
除了 MaxInterval 之外,每次后续重试都会增加 MaxInterval 的延迟。如果您想在尝试一定次数后停止重试,我们建议使用 Dead Letter Queues。
本篇关于《Google Pub/Sub 的 RetryPolicy 中配置的指数退避如何工作?》的介绍就到此结束啦,但是学无止境,想要了解学习更多关于Golang的相关知识,请关注golang学习网公众号!
如何在 Revel 控制器中获取 http.ResponseWriter 和 http.Request
- 上一篇
- 如何在 Revel 控制器中获取 http.ResponseWriter 和 http.Request
- 下一篇
- 使用 golang 迭代超过 10,000 个 postgresql 行需要很长时间(20 分钟),我如何加快速度?
-
- Golang · Go问答 | 19小时前 |
- Go t.Cleanup注册后测试提前Fatal的资源释放边界
- 399浏览 收藏
-
- Golang · Go问答 | 20小时前 |
- Go testing t.Parallel与t.Setenv冲突时的组织方式
- 265浏览 收藏
-
- Golang · Go问答 | 22小时前 | 并发 · go · sync.Mutex go vet copylocks
- Go mutex复制后锁状态失效的代码审查要点
- 431浏览 收藏
-
- Golang · Go问答 | 23小时前 | 并发 · go · 排查 · 数据竞争 Go并发 sync/atomic
- Go atomic值混用普通读写引起数据竞争的修复清单
- 289浏览 收藏
-
- Golang · Go问答 | 23小时前 |
- Go sync.Pool取回旧对象状态时的重置排查
- 327浏览 收藏
-
- Golang · Go问答 | 23小时前 |
- Go copy返回长度小于预期时的切片容量分析
- 246浏览 收藏
-
- Golang · Go问答 | 23小时前 | 排序 · go ·
- Go sort.Slice比较器不满足严格弱序时的异常表现
- 404浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 543次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 516次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 500次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 485次学习
-
- PubMedQA
- 深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
- 197次使用
-
- H2O EvalGPT
- H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
- 252次使用
-
- LMArena
- LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
- 207次使用
-
- HELM
- 深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
- 192次使用
-
- CMMLU
- 深入了解CMMLU中文评估基准,涵盖67个学科主题,提供数据集下载、Zero-shot/Five-shot评估方法及排行榜,助力优化中文语言模型性能。
- 182次使用
-
- 用Nginx反向代理部署go写的网站。
- 2023-01-17 502浏览
-
- GoLand调式动态执行代码
- 2023-01-13 502浏览
-
- Go sql.Tx提交成功前读取结果导致事务边界混乱的修复方法
- 2026-09-20 501浏览
-
- Go select 用 time.After 做超时有什么资源代价
- 2026-09-10 501浏览
-
- Go 取 range 变量地址为什么得到重复指针
- 2026-09-07 501浏览

