Kubernetes v1.37 原生直方图 Beta 后 Prometheus 兼容点怎么查
Kubernetes v1.37 已把原生直方图支持推进到 Beta,并默认打开 NativeHistograms feature gate,但这不等于 Prometheus 自动开始存储原生直方图。兼容性要从 Kubernetes 组件暴露、Prometheus 抓取配置、查询与转发链路三层分别确认。
官方地址:https://kubernetes.io/docs/reference/instrumentation/native-histograms/
Prometheus 参考:https://prometheus.io/docs/specs/native_histograms/
迁移期最稳妥的做法是:Prometheus 3.x 对目标 job 开启scrape_native_histograms,同时保留always_scrape_classic_histograms;只有确认面板、告警、remote_write 和联邦链路都能处理后,才考虑减少经典格式。
- v1.37 默认开启的是 Kubernetes 组件侧能力,每个组件仍可独立配置。
- Prometheus 3.x 需要按 job 开启原生直方图抓取,并确保协议协商包含 PrometheusProto。
- 经典与原生直方图不能直接混合聚合,跨切换时间段的范围查询也可能不完整。
先确认 Kubernetes 端确实具备双格式暴露
v1.37 的 Beta 实现建立在 Kubernetes 组件指标子系统上。默认开启 feature gate 后,支持的控制面和节点组件会在抓取协议允许时暴露经典与原生格式。这里有两个容易混淆的点:第一,组件之间不是一个总开关;第二,只有请求的协议支持原生直方图时,Prometheus 才有机会拿到对应数据。
因此升级后先记录实际抓取对象:kube-apiserver、kube-scheduler、kubelet 等分别看,不要只根据集群版本判断所有目标都已切换。若某个组件显式关闭了 NativeHistograms,它仍可能只提供经典直方图。

Prometheus 端要查三个配置点
Prometheus 2.40 起具备实验性原生直方图支持,3.0 到 3.7 已稳定但仍建议按 job 控制;3.8 起稳定配置继续以 scrape_native_histograms 为主,3.9 及以后不要再依赖已移除的全局旧开关。迁移期可以先这样配置一个 Kubernetes job:
scrape_configs:
- job_name: 'kubernetes-apiservers'
# 让 Prometheus 摄取目标暴露的原生直方图样本。
scrape_native_histograms: true
# 迁移期间保留经典桶,给旧面板和告警留回退路径。
always_scrape_classic_histograms: true
如果配置过 scrape_protocols,还要确认列表里有 PrometheusProto。原生直方图需要 Protobuf 暴露格式;自定义协议优先级时漏掉它,最常见的结果就是 Kubernetes 端“已经支持”,Prometheus 端却只收到经典样本。
| 检查对象 | 看到什么 | 不符合时怎么处理 |
|---|---|---|
| Kubernetes feature gate | v1.37 默认开启,组件可独立覆盖 | 检查对应组件启动参数和实际抓取目标 |
| Prometheus 抓取 job | scrape_native_histograms: true | 先按单个 job 灰度,不要全局一次切换 |
| 抓取协议 | 未自定义时由 Prometheus 选择 Protobuf;自定义时含 PrometheusProto | 修正协议列表后再看摄取结果 |
| 经典兼容 | 迁移期保留 always_scrape_classic_histograms: true | 确认旧面板、告警和下游接收端后再关闭 |
兼容性重点不在“能不能抓”,而在“怎么查”
经典直方图通常拆成带 le 标签的 _bucket、_sum 和 _count 序列;原生直方图则以一个结构化样本保存动态桶。原有基于 rate(metric_bucket[5m]) 的面板不能简单假设会自动得到同样的输入,查询要按 Prometheus 原生直方图函数和样本类型重新核对。
更重要的是,经典和原生直方图不能直接互相聚合。某个 job 在某天从经典切到原生后,包含切换点的范围向量可能只有一部分样本;跨时间对比时不要把“曲线断了”误判成业务延迟突然归零。若必须维持连续看板,先保留经典格式,或把切换时间作为查询和告警的明确边界。

remote_write、联邦和回退路径要单独核对
Prometheus 的 remote_write 需要显式设置 send_native_histograms: true 才会发送原生直方图;接收端不支持时会忽略新增字段,所以“发送成功”不代表下游保存了原生样本。联邦抓取也要在下游 Prometheus job 上开启 scrape_native_histograms,并优先使用 Protobuf。
上线前建议按“一个组件、一个 job、一个看板”做灰度:先确认抓取目标、查询结果和规则评估,再观察远程写入接收端。如果旧版本 Prometheus 或第三方接收端无法处理,就保留经典格式;回退时优先关闭 Prometheus 端的原生摄取配置,不要为了追求新样本而改指标名。
常见问题
Kubernetes v1.37 升级后一定要改 Prometheus 吗?
不一定。旧 Prometheus 可以继续抓经典格式;如果要摄取原生直方图,才需要按版本增加相应配置。
为什么 feature gate 开了却看不到原生样本?
先查抓取协议和 Prometheus job。自定义 scrape_protocols 时缺少 PrometheusProto,或 job 没开 scrape_native_histograms,都会导致只看到经典样本。
可以马上关闭经典直方图吗?
不建议直接切。先确认旧面板、告警、remote_write、联邦和跨时间范围查询,再按 job 灰度关闭。
判断这次升级是否兼容,核心不是看版本号,而是沿着“组件暴露—协议协商—Prometheus 摄取—查询和下游”逐层核对。只要保留经典回退,原生直方图就可以先作为可控的迁移增量。
Go archive/zip 如何控制文件名
- 上一篇
- Go archive/zip 如何控制文件名
- 下一篇
- DateTimeImmutable 状态怎么配置或排查
-
- 科技周边 · 业界新闻 | 2小时前 |
- 开源项目宣布毕业后企业升级流程应先核对什么
- 407浏览 收藏
-
- 科技周边 · 业界新闻 | 3小时前 | 云原生 · kubernetes · CNCF · 行业报告 · 云原生 Kubernetes 采用率 CNCF Survey
- 云原生报告中的调查比例为什么不能直接当作采用率
- 484浏览 收藏
-
- 科技周边 · 业界新闻 | 4小时前 | CI/CD · gitHub actions · GitHub Changelog · 生产流水线 ·
- GitHub Changelog 如何筛选影响生产流水线的变更
- 194浏览 收藏
-
- 科技周边 · 业界新闻 | 5小时前 | opentelemetry · 可观测性 · CNCF · 语义约定 · 指标日志链路 · OpenTelemetry毕业 OpenTelemetry语义约定 指标日志链路统一命名 Semantic Conventions 可观测性字段规范
- OpenTelemetry 毕业后如何规划指标、日志和链路统一命名
- 146浏览 收藏
-
- 科技周边 · 业界新闻 | 8小时前 | 依赖管理 · gitHub actions · 业界新闻 · 持续集成 · 项目依赖 GitHub Actions runner images 镜像更新 CI兼容性
- GitHub Actions runner 镜像更新前如何验证项目依赖
- 152浏览 收藏
-
- 科技周边 · 业界新闻 | 9小时前 |
- KubeCon 议题中 GPU 调度和可观测性如何分别落到工程任务
- 351浏览 收藏
-
- 科技周边 · 业界新闻 | 10小时前 | 云原生 · 容器镜像 · 镜像供应链 · Dockerfile Cloud Native Buildpacks Buildpacks
- 云原生应用采用 Buildpacks 后 Dockerfile 还要保留什么
- 487浏览 收藏
-
- 科技周边 · 业界新闻 | 11小时前 |
- GitHub CodeQL 支持 Linux ARM64 后如何调整扫描矩阵
- 457浏览 收藏
-
- 科技周边 · 业界新闻 | 14小时前 | CI/CD · gitHub actions · 供应链安全 · GitHub Actions cache-mode Actions缓存
- GitHub Actions cache-mode 更新后如何限制缓存访问范围
- 301浏览 收藏
-
- 科技周边 · 业界新闻 | 15小时前 |
- Kubernetes 新调度能力影响 GPU 任务时先看哪些配置
- 245浏览 收藏
-
- 科技周边 · 业界新闻 | 16小时前 |
- OpenTelemetry 毕业后项目使用方如何核对治理状态
- 460浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 543次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 516次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 500次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 485次学习
-
- H2O EvalGPT
- H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
- 110次使用
-
- LMArena
- LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
- 24次使用
-
- OpenCompass
- OpenCompass是上海AI实验室推出的开源大模型评测平台,提供CompassKit、CompassHub和CompassRank三大核心组件,支持LLM及多模态模型的一站式标准化评估与排行榜查询。
- 44次使用
-
- AGI-Eval
- AGI-Eval是由上海交大等高校联合发布的大模型评测社区,提供公正透明的LLM能力榜单、多领域评测集及Data Studio数据服务,助力AI模型性能评估与NLP科研开发。
- 23次使用
-
- SuperCLUE
- SuperCLUE是权威的中文大语言模型综合评测基准,涵盖语言理解、知识应用、AI Agent智能体及安全性等12项核心能力。通过多轮对话与客观测试,定期发布榜单与技术报告,为模型研发、优化及行业选型提供科学依据。
- 264次使用
-
- Go chassis云原生微服务开发框架应用编程实战
- 2022-12-29 214浏览
-
- golang通过node_exporter监控GPU及cpu频率、温度的代码
- 2022-12-31 166浏览
-
- 详解prometheus监控golang服务实践记录
- 2022-12-24 124浏览
-
- golang实现对docker容器心跳监控功能
- 2022-12-24 175浏览
-
- 一文带你玩转GolangPrometheusEexporter开发
- 2023-02-25 133浏览

