当前位置:首页 > 文章列表 > 数据库 > MySQL > 直方图选择性估计怎么配置或排查

直方图选择性估计怎么配置或排查

来源:17golang原创 2026-09-13 05:12:54 0浏览 收藏

MySQL 慢查询排查到一半,常会遇到一个尴尬现象:索引明明存在,优化器却把过滤结果估得过多或过少,最后选了不合适的访问路径。直方图选择性估计解决的是“列值分布不均匀,但现有索引统计不足”这一小块问题。它不会替代索引,也不会保证每条 SQL 都换计划。

官方地址:https://dev.mysql.com/doc/refman/8.4/en/

要点速览
  • 先用 EXPLAIN 证明是行数估计偏差,再决定是否建直方图。
  • 用 UPDATE HISTOGRAM 配置桶数,用 COLUMN_STATISTICS 检查结果。
  • 重建后必须比较估计行数、实际行数和耗时;效果不佳时可只删除目标列统计。

先确认问题真的是选择性估计

假设订单表的 channel 列大多数值是 web,少量值是 partner。查询少量合作渠道订单时,如果优化器按均匀分布猜测,估计行数就可能偏离实际数量。先固定同一条 SQL 查看计划:

-- 用 JSON 计划保留估计行数,便于和实际查询结果对照
EXPLAIN FORMAT=JSON
SELECT order_id, created_at
FROM shop_order
WHERE channel = 'partner' AND created_at >= '2026-01-01';

记录过滤条件、预估 rows、访问类型和实际返回行数。若偏差只在某个非均匀分布列上反复出现,再考虑直方图;如果是缺少联合索引、表达式导致索引失效或统计信息整体过期,应该先处理那些根因。

用 UPDATE HISTOGRAM 配置目标列

直方图按列保存,创建或替换都通过 ANALYZE TABLE 完成。默认桶数是 100,也可以在 1 到 1024 之间指定;一次只处理当前表中列出的目标字段。

-- 先为分布偏斜的列生成 64 个桶,避免一次改动过多列
ANALYZE TABLE shop_order
  UPDATE HISTOGRAM ON channel WITH 64 BUCKETS;

-- 需要撤销时只删除 channel 的直方图,不影响其他列
-- ANALYZE TABLE shop_order DROP HISTOGRAM ON channel;

桶数不是越大越好。数据量小、取值集中时,64 或默认值通常已经足够;高基数且分布复杂的列可以在测试环境比较不同桶数,但不要把每次重建都安排在高峰期。直方图是持久化的列统计信息,重建会替换该列已有的结果。

MySQL ANALYZE TABLE 为 shop_order.channel 配置直方图桶数的操作示意图
图1:MySQL 直方图配置操作示意图,展示目标列、桶数与替换范围的对应关系。

从 COLUMN_STATISTICS 判断它是否有效

不要只看 ANALYZE TABLE 返回成功就结束。直方图信息可从 INFORMATION_SCHEMA.COLUMN_STATISTICS 读取;该视图会返回数据库、表、列以及 JSON 格式的 HISTOGRAM

-- 读取指定列的直方图 JSON,确认统计对象没有查错库或表
SELECT SCHEMA_NAME, TABLE_NAME, COLUMN_NAME, HISTOGRAM
FROM INFORMATION_SCHEMA.COLUMN_STATISTICS
WHERE SCHEMA_NAME = DATABASE()
  AND TABLE_NAME = 'shop_order'
  AND COLUMN_NAME = 'channel';

重点看 JSON 中的 histogram-typenumber-of-buckets-specifiedsampling-ratelast-updated。查不到记录,可能是目标列没有直方图,也可能是当前账号看不到该列;先确认权限和表名。采样率小于 1 时,结果来自样本,重建两次可能出现细微差异,不要仅凭一次计划变化下结论。

MySQL COLUMN_STATISTICS 与 EXPLAIN 估计行数对照的结果示意图
图2:MySQL 统计检查结果示意图,把 COLUMN_STATISTICS 的采样信息与 EXPLAIN 行数估计放在同一排查视图中。

重建之后用实际行数反向验证

重新运行原查询的 EXPLAIN,在可接受的测试窗口使用 EXPLAIN ANALYZE 对照实际执行结果。你要看的是估计行数是否更接近实际、访问路径是否适合,以及总耗时和锁等待有没有变差。计划改变只是中间证据,不是性能结论。

现象优先检查处理动作
没有 COLUMN_STATISTICS 记录列名、库名、权限、是否真的执行 UPDATE确认对象后重新生成
估计仍与实际差距大采样率、数据是否近期大量变化、是否存在列相关性在低峰重建并复测,必要时调整索引
计划变了但更慢回表量、排序、连接顺序和冷缓存影响保留对照数据,测试后 DROP HISTOGRAM
-- 只移除造成问题的列统计,先保留 EXPLAIN 对照记录
ANALYZE TABLE shop_order DROP HISTOGRAM ON channel;

当过滤条件涉及多个强相关列时,单列直方图不能表达列之间的联合分布;这时继续增加桶数通常不是答案。生产操作前保存旧计划、SQL 样本和复测结果,回退时也只回退这一个统计对象。

常见问题

直方图会自动给没有索引的列加速吗?

不会。它补充优化器的分布估计,不创建索引,也不改变查询必须扫描的数据量。

为什么更新直方图后执行计划没变?

可能原计划已经足够合理,或者该 SQL 的过滤形状没有使用这份列统计。应以估计与实际行数、耗时和访问路径一起判断。

桶数应该直接设为 1024 吗?

不建议。桶数需要结合数据量、分布复杂度和生成成本,在测试环境用同一组 SQL 做对比。

版本声明
本文转载于:17golang原创 如有侵犯,请联系study_golang@163.com删除
Go http.ServeContent 怎么读取Range 区间Go http.ServeContent 怎么读取Range 区间
上一篇
Go http.ServeContent 怎么读取Range 区间
Go panicreturn 怎么处理命名结果
下一篇
Go panicreturn 怎么处理命名结果
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • H2O EvalGPT:开源LLM大模型评估与排行榜工具
    H2O EvalGPT
    H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
    110次使用
  • LMArena是什么?伯克利AI模型评估平台使用指南与功能解析
    LMArena
    LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
    25次使用
  • OpenCompass大模型评测体系详解:功能、使用指南与应用场景
    OpenCompass
    OpenCompass是上海AI实验室推出的开源大模型评测平台,提供CompassKit、CompassHub和CompassRank三大核心组件,支持LLM及多模态模型的一站式标准化评估与排行榜查询。
    44次使用
  • AGI-Eval大模型评测平台:权威榜单、数据集与人机协同评测方案
    AGI-Eval
    AGI-Eval是由上海交大等高校联合发布的大模型评测社区,提供公正透明的LLM能力榜单、多领域评测集及Data Studio数据服务,助力AI模型性能评估与NLP科研开发。
    25次使用
  • SuperCLUE中文大模型评测基准:功能、能力维度与应用指南
    SuperCLUE
    SuperCLUE是权威的中文大语言模型综合评测基准,涵盖语言理解、知识应用、AI Agent智能体及安全性等12项核心能力。通过多轮对话与客观测试,定期发布榜单与技术报告,为模型研发、优化及行业选型提供科学依据。
    264次使用
微信登录更方便
  • 密码登录
  • 注册账号
登录即同意 用户协议隐私政策
返回登录
  • 重置密码